نماذج ومنصات الذكاء الاصطناعي

أنثروبيك تُصدر Claude Sonnet 5.5 بأسعار Sonnet 5 دون تغيير

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

أصدرت أنثروبيك Claude Sonnet 5.5 في 28 سبتمبر 2026، النموذج الثاني في عائلة Claude 5.5. يحافظ النموذج على تسعيرة Claude Sonnet 5 عند 2 دولار لكل مليون رمز مدخل و10 دولارات لكل مليون رمز مخرج، وتقول أنثروبيك إنه يولد المخرجات بأكثر من 30٪ أسرع مع تكلفة أقل تصل إلى 30٪ لكل مهمة في اختباراتهم.

في إعلان الإصدار، وصفت أنثروبيك Sonnet 5.5 بأنه مكمل أسرع وأقل تكلفة لـ Claude Opus 5.5، وتقول الشركة إنه مُصمم للعمل المعقد الذي يتطلب حكماً دقيقاً. يُعد Sonnet 5.5 الأقوى في المهام اليومية المحددة جيداً، وإصلاح الأخطاء، وإنتاج مستندات، شرائح، وجداول بيانات مصقولة، وفقاً لأنثروبيك، مضيفةً أنه يمتلك أيضاً حساً حاداً للتصميم.

يتوفر Claude Sonnet 5.5 على جميع المنصات، بما في ذلك Amazon Web Services وGoogle Cloud وMicrosoft Azure، تحت معرّف النموذج claude-sonnet-5-5، ويُقدَّم بدون احتفاظ بالبيانات، كما هو الحال مع Opus 5.5 وSonnet 5.

نتائج المعايير المبلغ عنها

تُبلغ أنثروبيك أن Sonnet 5.5 يحصل على 70.6٪ في Terminal-Bench 4.0، وهو تقييم برمجة وكيلية، مقابل 10.3٪ لـ Sonnet 5، مع درجة Opus 5.5 المسجلة البالغة 66.4٪ التي تعكس نتيجته Xhigh‑effort. في المجموعة الرئيسية لـ FrontierCode 1.1، يحقق Sonnet 5.5 نسبة 46.2٪ بجهد Max و52.1٪ بجهد Xhigh، مقارنةً بـ 42.4٪ لـ Sonnet 5، و54.4٪ لـ Opus 5.5، و49.3٪ لـ GPT-6 Sol من OpenAI. الدرجات المبلغ عنها في CursorBench 4.0 هي 55.5٪ لـ Sonnet 5.5، و34.1٪ لـ Sonnet 5، و57.8٪ لـ Opus 5.5.

في تقييمات أعمال المعرفة، تُبلغ الشركة عن درجة GDPval‑AA v2.1 بقيمة 1844 لـ Sonnet 5.5، أي نقطتين أقل من Opus 5.5 التي سجلت 1846 وحوالي 400 نقطة أعلى من Sonnet 5 الذي سجل 1449، وكذلك درجة AA‑Briefcase v1.1 بقيمة 1811 مقارنةً بـ 1822 لـ Opus 5.5 و1359 لـ Sonnet 5. كما تُدرج الإعلانات 64.5٪ مع الأدوات في Humanity’s Last Exam، و80.1٪ ائتمان جزئي في OSWorld 2.1، و61.6٪ بدون أدوات في Chartography، وهو اختبار تعرّف بصري على المخططات. وتقول أنثروبيك إن Sonnet 5.5 هو أول نموذج Sonnet يتفوق على Pokémon Red باستخدام لقطات الشاشة فقط.

تحذر الشركة من أن درجات المعايير تلتقط جانبًا واحدًا فقط من قدرات النموذج، وتقول إن اختباراتهم واختبارات المختبرين الخارجيين تُظهر أن Opus 5.5 لا يزال أقوى بوضوح في الأعمال المعقدة المفتوحة التي تتطلب حكماً مستمراً. تشير هامش توضيحي إلى أن Artificial Analysis أجرى GDPval‑AA وAA‑Briefcase على نشر ما قبل الإصدار مع خطأ في المخرجات المهيكلة تم إصلاحه، وسيقلل، إن حدث ذلك، من تقييم أداء Sonnet 5.5. وتُشير هامش آخر إلى أن OpenAI أصلحت مؤخرًا خطأً في فهم الصور في GPT‑6 Sol قد لا تعكسه الدرجات التي تقدمها الأطراف الثالثة بعد.

نتائج المختبرين الأوائل

قال نائب رئيس الذكاء الاصطناعي في CodeRabbit، ديفيد لوكر، إن Sonnet 5.5 يُظهر حكماً أفضل من Sonnet 5 عبر مستويات التعقيد مع استهلاك أقل بكثير من الرموز المخرجة، وأن CodeRabbit يخطط لنقل المراجعات البسيطة والمتوسطة إلى النموذج الآن، مع المزيد في الأسابيع القادمة. وأفاد قائد الهندسة في Base44 AI، غابرييل غرينبرغ، أنه عبر 118 بناء تطبيق حقيقي، حقق Sonnet 5.5 متوسط 3.6 تكرار لكل بناء مقارنةً بـ 7.7 في Opus 5، مع أقل عدد من استدعاءات الأدوات الفاشلة بين جميع النماذج التي قارنت بها Base44.

أفاد مهندس Slack الرئيسي كورتيس ألين أن هناك انخفاضًا بنحو 14٪ في عدد الرموز المخرجة في تقييمات Slackbot غير المتصلة دون أي تغييرات في المطالبات. وقال مدير الذكاء الاصطناعي في Zendesk، أبينه كاثوريا، إن التذاكر تمت معالجتها أسرع بنسبة 20٪ مقارنةً بنماذج Claude التي تستخدمها Zendesk في الإنتاج. وأبلغت Balyasny Asset Management عن حوالي 121,000 رمز لكل إجابة مقابل 497,000 رمز في Sonnet 5 عبر مجموعة خاصة من 2,441 مهمة مالية. وأفادت Box أن النتائج كانت أسرع بـ 2.4 مرة مع انخفاض إجمالي الرموز بنسبة 12٪، وقالت Atlassian إن العملاء يمكنهم تشغيل Rovo Agents أسرع حتى 30٪ مقارنةً بـ Sonnet 5.

التسعير والسرعة والهجرة

تطابق الأسعار المدرجة لـ Sonnet 5.5 تمامًا أسعار Sonnet 5: 2 دولار لكل مليون رمز مدخل، 10 دولارات لكل مليون رمز مخرج، 0.20 دولار لكل مليون رمز قراءة ذاكرة مؤقتة، و2.50 دولار لكل مليون رمز كتابة ذاكرة مؤقتة. تُسعر Opus 5.5 بـ 4 دولارات للمدخل، 20 دولارًا للمخرج، و5 دولارات لكتابات الذاكرة المؤقتة. تقول أنثروبيك إن Sonnet 5.5 يحتاج عادةً إلى رموز أقل بكثير لنفس العمل وهو أسرع نموذج Sonnet لديها حتى الآن.

يقدم النموذج خمسة مستويات جهد معاد ضبطها: منخفض، متوسط، عالي، xhigh، وأقصى. الإعدادات الافتراضية هي متوسط في Claude Code وتطبيقات Claude، وعالي على منصة Claude، وهي أيضًا الإعداد الافتراضي لواجهة البرمجة التطبيقية.

قائمة دليل الترحيل الخاصة بـ Anthropic تُظهر التغييرات الجذرية للمطورين الذين ينتقلون من Sonnet 5. الآن يصبح التفكير التكيفي مُفعَّلًا بشكل افتراضي، وإعداد التفكير المعطل يُعيد خطأ 400، ويجب على المطورين الذين كانوا يستخدمون Sonnet مع إيقاف التفكير الانتقال إلى الإعداد الجديد بينإعداد الأدوات، الأدنى المتاح، قبل الترحيل، frontierllm، والتفكيراستخراج، وعمومًاالأضرار، وتُشير الوثائق إلى أن محاولات الاسترجاع الجانبية على الخادم تُعيد فقط رفض الأمن السيبراني وfrontier_llm في Sonnet 5.

نتائج السلامة والضمانات

نظرًا لأن قدرات السايبر في Sonnet 5.5 تُقارن بقدرات Opus 5، صرّحت Anthropic بأنه أول نموذج Sonnet يُطلق مع إجراءات الحماية السايبرية والبدائل المستخدمة في أكثر نماذج الشركة قدرة. تُظهر system card أنه عندما تُعطَّل إجراءات الحماية، حقق Sonnet 5.5 متوسط 11.53 علم قدرة ومعدل التقاط 80٪ على ExploitBench وأنتج 178 استغلالًا كاملًا لتنفيذ الشيفرة العشوائية، مقارنةً بواحد فقط لنموذج Sonnet 5. أكمل 46.1٪ من تحديات CyScenarioBench مقابل 0.7٪ لنموذج Sonnet 5، وأنتج 50 اختطافًا لتدفق التحكم على معيار الاستغلال الثنائي مقارنةً بـ 3 لنموذج Sonnet 5.

تعمل إجراءات الحماية السايبرية على ثلاث مراحل: فحص على تنشيطات النموذج الداخلية، ومصنف خفيف الوزن داخل النموذج، ومصنف LLM مدرب منفصل. تُظهر البطاقة أن الاستدعاء وصل إلى 99.43٪ على مجموعة تغطية الأضرار السايبرية ومعدل نجاح الهجوم 21.0٪ في تقييم صلابة المهاجم العكسي، محسنًا من 57.2٪ لنموذج Sonnet 5، مع تحذير المستخدمين من توقع زيادة الرفض حتى في مهام الأمن السيبراني البسيطة. تُحوَّل الطلبات ذات المخاطر الأعلى بوضوح إلى Sonnet 5، وسيُقدِّم برنامج التحقق السايبرية الموسَّع قريبًا مدافعين مُعتمدين وصولًا طبقيًا إلى القدرات المتقدمة في نماذج Sonnet 5.5 و Opus 5.5 و Claude Mythos.

إجراءات الحماية البيولوجية هي نفسها المصنِّفات المضادة للاستخدام الضار التي تُستَخدم في Opus 5، دون نموذج بديل، ويغطي Life Sciences Verification Program الوصول إلى كامل نطاق الأعمال البيولوجية. يُعد Sonnet 5.5 أيضًا أول نموذج Sonnet يحتوي على مصنِّفات أمان تمنع استخراج التفكير، ويُوسِّع التفكير المحفوظ بحيث لا يمكن فصل تفكير النموذج عن الحساب الذي أنشأه.

في تدقيق سلوك آلي أجرته Anthropic على نحوٍ تقريبي لـ 1,850 سيناريو، أفادت الشركة أن Sonnet 5.5 يُحسِّن أو يُطابق Sonnet 5 في معظم مقاييس التوافق، ومقاومة سوء الاستخدام، والصدق، ويسجل أدنى معدل لمحاولات الهروب من الصندوق التجريبي بين النماذج المختبرة، ويظهر تفكيرًا غير قابل للقراءة أكثر من العديد من النماذج السابقة. تُشير بطاقة النظام إلى أن Sonnet 5.5 لا يتجاوز أي حدود جديدة في سياسة التوسع المسؤول، ويُعامل على أنه يفي بحدود CB-1 و Autonomy-1 في السياسة، ويحمل خطرًا منخفضًا مُقَيَّمًا للتفاوت الكارثي. تاريخ قطع المعرفة الموثوقة للنموذج هو يونيو 2026.

صرّحت Anthropic أن Claude Haiku 5.5، المصمم للتطبيقات ذات الحجم العالي والحساسية للتكلفة، سينضم إلى عائلة Claude 5.5 في الأسابيع القليلة المقبلة.

يُعد Jonas Reeve محللاً مولَّدًا بالذكاء الاصطناعي في Unite.AI، يركز على الذكاء الاصطناعي الإدراكي، والذكاء العام الاصطناعي (AGI)، والأسس النظرية للذكاء الآلي. يستكشف عمله كيفية ظهور التعلم، والتفكير، والذاكرة، والتجريد في كل من الأنظمة البيولوجية والاصطناعية، ربطًا بين بنى الذكاء الاصطناعي الحديثة والأسئلة القديمة في علم النفس الإدراكي وفلسفة العقل.

من خلال نهجٍ مفاهيميٍ وتأملي، يفحص Jonas أطرًا مثل نماذج التفكير، والأنظمة الوكيلة، والإدراك الناشئ، ونظرية التوافق، سعيًا لتوضيح ما يعنيه التقدم نحو الـAGI فعليًا—وما لا يعنيه. بدلاً من مطاردة الجداول الزمنية أو الضجيج، يركز على المبادئ الأولى، والصرامة المفاهيمية، وحدود النماذج الحالية.

المقالات التي كتبها Jonas Reeve مُولَّدة بالذكاء الاصطناعي وتُراجع من قبل فريق التحرير في Unite.AI لضمان الدقة والوضوح والنقاش المسؤول حول مفاهيم الذكاء الاصطناعي المتقدمة.