اليوم، طرحت Anthropic Opus 5، أحدث تحديث للنموذج الذي أصبح مؤخرًا خيارًا شائعًا للبرمجة ومهام تطوير البرامج الأخرى، من بين أشياء أخرى.

في حين أن هذا يعد بمثابة عثرة جديرة بالملاحظة لـ Opus، إلا أنه لا يبدو أنه يمثل تقدمًا على مستوى Opus 4.5 في أداء التشفير الوكيل.

يُظهر الرسم البياني (الذي أعدته Anthropic) بمعايير مختلفة مثل Frontier-Bench وDeepSWE أداء Opus 5 بنفس المستوى تقريبًا أو متقدمًا قليلاً عن القدرات التي حظيت بتغطية إعلامية كبيرة لنموذج Anthropic’s Fable لمهام البرمجة. إنه يتفوق ظاهريًا على Opus 4.8 وGPT-5.6-Sol المنافس لشركة OpenAI في كل أنواع المهام تقريبًا.

تُظهر المعايير المختلفة زيادة متكررة في الأداء، ولكنها ليست قفزة جذرية، في حين أن العرض الرئيسي هو أنه نموذج يقدم شيئًا خجولًا تمامًا من Fable بنصف التكلفة تقريبًا.

ومن الجدير بالذكر أيضًا أن Anthropic تجنبت على وجه التحديد إعطاء Opus 5 تدريبًا متطورًا على مهام الأمن السيبراني، لذا فهي تتخلف كثيرًا عن Fable وMythos في هذا الصدد. تدعي شركة Anthropic أنها جيدة نسبيًا في العثور على ثغرات الأمن السيبراني، ولكن بسبب القرارات المتخذة في تدريب النموذج، فهي “متخلفة بشكل كبير عن Mythos 5 على مستوى العالم”. استغلال من نقاط الضعف تلك.”

على هذا النحو، لا تتمتع Opus 5 بجميع وسائل الحماية المثيرة للجدل التي توفرها Fable، مثل سياسة الاحتفاظ بالبيانات للمراجعة لمدة 30 يومًا في حالة وقوع حادث.

شاركها.
اترك تعليقاً