
في 28 سبتمبر، أعلنت أنتروبيك عن نموذج Claude Sonnet 5.5، الذي يعمل بأكثر من 30% أسرع ويكلف 30% أقل لكل مهمة مقارنة بسابقه، نموذج Sonnet 5. يحتفظ النموذج الجديد بالأسعار عند 2 دولار لكل مليون رمز مدخل و10 دولارات لكل مليون رمز مخرج. أفادت فريق أنتروبيك أن Sonnet 5.5 حصل على 70.6% في اختبار Terminal-Bench 4.0، بينما حصل Sonnet 5 على 10.3% فقط، و Opus 5.5 – 66.4%.
أصبح Sonnet 5.5 النموذج الثاني في عائلة Claude 5.5. في 22 سبتمبر، أطلقت أنتروبيك أيضًا Opus 5.5، في نفس اليوم الذي أطلقت فيه OpenAI نماذج GPT-6 Sol وLuna. أشارت أنتروبيك إلى أن Sonnet 5.5 لا توسع قدراتها، ومراجعتها تركز على المخاطر مثل تضليل المستخدمين والمساعدة في إساءة الاستخدام العالية. يتضمن النموذج أيضًا حماية سيبرانية ومضاد للتقطير، مما يمنع محاولات استخراج منطقه لتدريب الأنظمة المنافسة. من المتوقع إصدار Claude Haiku 5.5 في الأسابيع المقبلة.
ومع ذلك، توصلت شركة التحليل المستقلة Artificial Analysis إلى استنتاج مختلف بشأن التكلفة بعد إجراء اختبارات. وفقًا لبياناتهم، استخدم Sonnet 5.5 عددًا أكبر بكثير من الرموز لتحقيق النتائج. أظهر التحليل أنه عند أقصى حمل، استخدم Sonnet 5.5 حوالي 193 ألف رمز مخرج لكل مهمة في مؤشر Intelligence، وهو أعلى بنسبة 60% من Opus 5.5، وحوالي 7 مرات أكثر من GPT-6 Astra. ومع ذلك، أبلغ العملاء الذين لديهم وصول مبكر عن اتجاه معاكس مقارنة بـ Sonnet 5. على سبيل المثال، أشارت Balyasny Asset Management إلى أن Sonnet 5.5 استخدم حوالي 121 ألف رمز لكل إجابة في مهامهم المالية، بينما استخدم Sonnet 5 – 497 ألف. أجرت Artificial Analysis اختبارًا للنسخة الأولية من النموذج مع خطأ في المخرجات الهيكلية، والذي تم تصحيحه من قبل أنتروبيك. تخطط الشركة لإعادة إجراء التقييمات المناسبة في المستقبل القريب.





