تدور أحداث Anthropic’s Opus 5 حول الكفاءة الرمزية، وليس قفزة في القدرات

اليوم، طرحت Anthropic Opus 5، أحدث تحديث للنموذج الذي أصبح مؤخرًا خيارًا شائعًا للبرمجة ومهام تطوير البرامج الأخرى، من بين أشياء أخرى. في حين أن هذا يعد بمثابة عثرة جديرة بالملاحظة لـ Opus، إلا أنه لا يبدو أنه يمثل تقدمًا على مستوى Opus 4.5 في أداء التشفير الوكيل. يُظهر الرسم البياني (الذي أعدته Anthropic) بمعايير مختلفة مثل Frontier-Bench وDeepSWE أداء Opus 5 بنفس المستوى تقريبًا أو متقدمًا قليلاً عن القدرات التي حظيت بتغطية إعلامية كبيرة لنموذج Anthropic’s Fable لمهام البرمجة. إنه يتفوق ظاهريًا على Opus 4.8 وGPT-5.6-Sol المنافس لشركة OpenAI في كل أنواع المهام تقريبًا. تُظهر المعايير المختلفة زيادة متكررة في الأداء، ولكنها ليست قفزة جذرية، في حين أن العرض الرئيسي هو أنه نموذج يقدم شيئًا خجولًا تمامًا من Fable بنصف التكلفة تقريبًا. ومن الجدير بالذكر أيضًا أن Anthropic تجنبت على وجه التحديد إعطاء Opus 5 تدريبًا متطورًا على مهام الأمن السيبراني، لذا فهي تتخلف كثيرًا عن Fable وMythos في هذا الصدد. تدعي شركة Anthropic أنها جيدة نسبيًا في العثور على ثغرات الأمن السيبراني، ولكن بسبب القرارات المتخذة في تدريب النموذج، فهي “تتخلف بشكل كبير عن Mythos 5 فيما يتعلق باستغلال نقاط الضعف هذه”. على هذا النحو، لا تتمتع Opus 5 بجميع وسائل الحماية المثيرة للجدل التي توفرها Fable، مثل سياسة الاحتفاظ بالبيانات للمراجعة لمدة 30 يومًا في حالة وقوع حادث.
تم النشر: 2026-07-24 22:05:00
مصدر: arstechnica.com








