
Anthropic تطلق Claude Opus 5.5: أرخص بنسبة 40% من Opus 5
أطلقت Anthropic نموذج Claude Opus 5.5، أول نموذج في عائلة Claude 5.5 الجديدة. وتقول الشركة إنه يبلغ مستوى Claude Fable 5.1 في معظم المهام، بينما تقل كلفة تشغيله بنسبة 40% عن Opus 5.
أطلقت Anthropic في 22 سبتمبر/أيلول نموذج Claude Opus 5.5، أول نموذج في عائلة Claude 5.5 الجديدة. وتقول الشركة إنه يعمل بمستوى Claude Fable 5.1 في معظم المهام، بينما تقل كلفة تشغيله بنسبة 40% عن Opus 5.
الأداء والتكلفة
وفقاً لأرقام Anthropic، شهد المختبِرون الأوائل قفزات كبيرة في المهام المعقّدة. أنجز أحدهم ترحيل 680 ألف سطر من الشيفرة في أقل من يوم واحد، وهو عمل تقول الشركة إنه كان سيستغرق فريقاً هندسياً أسابيع. وفي مهمة لتقليل أزمنة التحميل في كل صفحات تطبيق ويب، نجح Opus 5.5 في 39 حالة من أصل 40، بينما أحدث Opus 5 تحسينات أصغر غيّرت أيضاً سلوك التطبيق.
بحسب الشركة، تبلغ كلفة قراءات الذاكرة المؤقتة، التي تشكل معظم كلفة العمل الوكيلي والبرمجة، 0.20 دولار لكل مليون رمز، أي أقل بنسبة 60% من Opus 5، كما يُولَّد الناتج أسرع بنسبة تزيد على 30%. ويتاح وضع سريع بسرعة تصل إلى 2.5 ضعف في Claude Code وClaude Platform بكلفة 8 دولارات لكل مليون رمز إدخال و40 دولاراً لكل مليون رمز إخراج.
الاختبارات المعيارية ونتائج العملاء
في اختبار FrontierCode v1.1، الذي يقيس ما إذا كانت تغييرات الشيفرة التي يقترحها الوكيل ستُدمج، يسجّل Opus 5.5 نسبة 54.6% بالجهد الافتراضي، متقدماً على كل النماذج الأخرى وعلى أعلى نتيجة لـ GPT-6 Astra البالغة 53.3%، وبكلفة تعادل نحو خُمس الكلفة لكل مهمة. وفي Terminal-Bench 4.0 يتغلب بالجهد الافتراضي على Opus 5 بأقصى جهد بنحو خُمس الكلفة، ويضاهي GPT-6 Astra بنحو 40% من الكلفة. وفي GDPval-AA v2.1، الذي يغطي عملاً واقعياً في 44 مهنة، يصل النموذج إلى 1846 نقطة Elo.
ويُبلّغ العملاء الذين استشهدت بهم Anthropic عن نتائج مشابهة. وتقول Hebbia إن Opus 5.5 غطّى 86.6% من معايير الخبراء المالية مقابل 60.3% لـ Opus 5، بينما تفيد Spotify بأن النموذج بلغ جودة Opus 5 في مهام البرمجة الوكيلية بنحو نصف عدد الخطوات والوقت ورموز الإخراج.
السلامة وضوابط الحماية
تقول Anthropic إن Opus 5.5 حقق أفضل النتائج حتى الآن في تدقيق السلوك الآلي، الذي يختبر Claude في نحو 2000 سيناريو، وهو أقوى نماذجها في معظم مقاييس الصدق. وفي تقييم جديد للبقاء داخل الحدود، حاول تجاوز القيود أقل بنحو 85% من Opus 5 أو Claude Mythos 5.1. وفي اختبار أجرته شركة الأمن Gray Swan يتعادل مع Fable 5.1 في أدنى نسبة نجاح لهجمات prompt injection بين كل النماذج المختبَرة.
وهو أول نموذج Opus يُطلق بضوابط حماية مشابهة لضوابط Fable 5.1 في الأمن السيبراني والأحياء والتقطير، إذ يُعاد توجيه معظم مهام الأمن السيبراني إلى Opus 4.8. ويأتي النموذج بـ"التفكير المحفوظ"، وهو إجراء مضاد للتقطير يسري على حسابات API المُنشأة في 31 أغسطس 2026 أو بعده، ولم يعد متاحاً مع إيقاف وضع التفكير.
التوافر
يتاح Claude Opus 5.5 الآن على Amazon Web Services وGoogle Cloud وMicrosoft Azure؛ وعلى منصة Claude يكون معرّف النموذج claude-opus-5-5.
SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي
نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.