أطلقت Anthropic رسميًا Claude Opus 5.5 يوم الثلاثاء، ليكون أول نموذج في عائلة Claude 5.5 التابعة للشركة. ويقدم النموذج الأحدث قفزة كبيرة في أداء البرمجة الوكيلية، مع استخدام عدد أقل من الرموز، وتقدمه الشركة بوصفه «عاملًا» مستقلًا أكثر قدرة. وقالت Anthropic أيضًا إن Opus 5.5 يخفض تكاليف المهام بنسبة 40% مقارنةً بـOpus 5.
وقالت Anthropic إن أحد المختبرين أكمل ترحيلًا لشيفرة مؤلف من 680,000 سطر في أقل من يوم، في مهمة كانت ستستغرق عادةً أسابيع لفريق هندسي.
قالت الشركة في بيان: «Claude Opus 5.5 هو أول إصدار لنا منذ دعوتنا إلى إبطاء وتيرة التقدم على حدود الذكاء الاصطناعي. وقد اختبره مقيّمون خارجيون قبل إطلاقه، من بينهم Frontier Design وMETR. وفي تدقيقنا السلوكي الآلي، وهو أشمل اختبار للمواءمة نجريه، يُعد Opus 5.5 النموذج الأقوى أداءً بين النماذج التي اختبرناها حتى الآن. كما يأتي مزودًا بإجراءات الحماية التي طورناها لنماذجنا الأكثر قدرة».
كما أن أسعار API الأساسية لـOpus 5.5 أقل من أسعار سلفه. إذ تخفض Anthropic تكلفة رموز الإدخال من $5 إلى $4 لكل مليون رمز، ورموز الإخراج من $25 إلى $20 لكل مليون رمز. وقالت الشركة إن ذلك يمثل خفضًا بنسبة 20% في أسعار الإدخال والإخراج على حد سواء، قبل احتساب الوفورات الإضافية الناتجة عن استخدام عدد أقل من الرموز لإنجاز المهام.
يتصدر Opus 5.5 المعايير المرجعية التي استشهدت بها Anthropic للبرمجة الوكيلية، بما في ذلك Terminal-Bench وFrontierCode وCursorBench. وفي أحد الاختبارات المبكرة، عمل النموذج بشكل مستقل لأكثر من 18 ساعة عبر ستة مستودعات للشيفرة، بينما أظهرت اختبارات أخرى قدرته على إجراء تحليلات مالية، وبناء نماذج وعروض تقديمية على Excel، وإجراء أبحاث. وقالت Anthropic إن 16 من أصل 18 تقريرًا بحثيًا داخليًا استوفت معيار الجودة لديها، مقارنةً بصفر في حالة Opus 5 أو Fable 5.1.
لكن Anthropic حذرت من أن الفروق بين المعايير المرجعية أصبحت أقل موثوقية عند هذا المستوى من القدرات، وقالت إن الفجوة في العالم الحقيقي بين Opus 5.5 وFable 5.1 أضيق مما توحي به أرقام المعايير.
وقالت الشركة إن Claude Sonnet 5.5 وClaude Haiku 5.5 سيتبعان خلال الأسابيع المقبلة.
ويأتي طرح Opus 5.5 في وقت يواصل فيه قطاع الذكاء الاصطناعي عمومًا مواجهة ردود فعل عامة غاضبة، على خلفية منشور لباحث سابق قال إن النموذج قد يدمر البشرية خلال السنوات العشر المقبلة.
وفي الأسبوع الماضي، نشرت Anthropic إطارًا للشفافية في مجال الذكاء الاصطناعي، بينما دعا الرئيس التنفيذي Dario Amodei إلى إبطاء وتيرة القطاع بأكمله. وقالت OpenAI يوم الاثنين إن على الولايات المتحدة قيادة إطار عالمي للذكاء الاصطناعي وسط تزايد المخاوف المتعلقة بالسلامة.
