كشفت شركة Anthropic النقاب عن Claude Opus 5، وهو نموذج جديد للذكاء الاصطناعي تقول الشركة إنه يقدم معلومات استخباراتية قريبة من الحدود تقريبًا بنصف سعر نموذج Fable 5 من الدرجة الأولى. تم إصدار Opus 5 في 24 يوليو 2026، وهو الآن النموذج الافتراضي لـ Claude Max وأقوى نموذج متاح لـ Claude Pro، مما يجعله بمثابة العمود الفقري اليومي لشركة Anthropic للبرمجة والوكلاء المستقلين وعمل المعرفة المهنية.

يأتي الإطلاق في وقت تقوم فيه الشركات بفحص الإنفاق على الذكاء الاصطناعي. وفقًا لـ CNBC، فإن النموذج الجديد "ينافس Fable 5 وهو أرخص لأن الشركات تقلق بشأن التكاليف"، بينما وصفته بلومبرج بأنه "نموذج أكثر فعالية من حيث التكلفة للمهام اليومية". بالنسبة للفرق التي تتابع أحدث تطورات الذكاء الاصطناعي، تمثل Opus 5 رهانًا متعمدًا على أن ساحة المعركة التنافسية التالية هي القيمة، وليس التفوق المعياري الخام.

الأداء المعياري: أحدث ما توصلت إليه التكنولوجيا في مجال البرمجة والمعرفة

تفيد تقارير أنثروبيك أن Opus 5 تنشر أحدث النتائج في تقييمات البرمجة والعمل المعرفي بما في ذلك Frontier-Bench وGDGVal-AA. في إصدار Frontier-Bench v0.1، تقول الشركة إن Opus 5 يتفوق على جميع الطرازات الأخرى ويزيد من أداء سابقتها، Opus 4.8، بتكلفة أقل لكل مهمة.

في CursorBench 3.2، تأتي Opus 5 ضمن 0.5% من أعلى نقاط Fable 5 بينما تكلف نصف التكلفة لكل مهمة، وفقًا لمعايير Anthropic الخاصة. وأشار Decrypt إلى أن النموذج "يتفوق على Fable 5 في معظم المعايير - بنصف السعر."

تمتد المكاسب إلى التقييمات الفعالة وتقييمات حل المشكلات:

  • ARC-AGI 3: حصل Opus 5 على درجات أعلى بثلاث مرات تقريبًا من ثاني أفضل نموذج في اختبار حل المشكلات الجديد هذا.
  • Zapier AutomationBench: معدل نجاح يبلغ حوالي 1.5 ضعف النموذج التالي الأفضل بنفس التكلفة، وهو ما يقيس إكمال مهام العمل من البداية إلى النهاية.
  • OSWorld 2.0 (استخدام الكمبيوتر): يتفوق Opus 5 على أفضل نتيجة لـ Fable 5 بما يزيد قليلاً عن ثلث التكلفة.

والجدير بالذكر أن Anthropic تعترف بأن Opus 5 "لا تزال خلف Mythos 5 في مهام الأمن السيبراني"، وهي منطقة يحتفظ فيها النموذج الحدودي المنافس بالصدارة.

وكالة أقوى والتحقق الذاتي

الموضوع المتكرر في الإعلان هو تحسين قدرة Opus 5 على التحقق من عملها وتكرارها حتى تنجح. وصفت أنثروبيك عدة أمثلة من اختبارات الوصول المبكر التي تسلط الضوء على هذه الاستقلالية.

في إحدى مهام Frontier-Bench، تم إعطاء النموذج رسمًا لجزء من الآلة وطُلب منه كتابة تعليمات برمجية لإعادة بنائه كنموذج FreeCAD ثلاثي الأبعاد - ولكن لم يتم إعطاؤه عمدًا أي طريقة لعرض الرسم مباشرة. وبحسب ما ورد، قامت Opus 5 بكتابة مسار الرؤية الحاسوبية الخاص بها لاستخراج الأشكال الهندسية من وحدات البكسل الأولية، ثم أعادت بناء الجزء بالكامل، ونجحت مرارًا وتكرارًا حيث لم يتمكن أي نموذج منافس من حل المهمة بعد خمس محاولات.

نظرًا لخلل حقيقي في مدير الحزم مفتوح المصدر الشهير، وجدت Opus 5 السبب الجذري وأصلحت حالة حافة أخطأها التصحيح الخاص بالمجتمع، في حين أصلح النموذج المنافس فقط الأعراض السطحية وأعلن حل الخطأ. يقال إن أحد المهندسين في إحدى الشركات التجارية استخدم Opus 5 لإنشاء موجز بيانات السوق لبورصة جديدة في جلسة واحدة - وهي مهمة لم تتمكن النماذج السابقة من إكمالها على الإطلاق - ولم يجد النموذج أي بث مباشر للتحقق من صحته، فقام النموذج ببناء أداة الاختبار الخاصة به.

##استقبال العملاء

قدم شركاء الوصول المبكر تقييمات إيجابية إلى حد كبير. قال سكوت وو، الرئيس التنفيذي لشركة Cognition (صانع وكيل ترميز Devin)، إن Opus 5 "يقترب من الأداء على مستوى Fable بنصف التكلفة" ويظهر "قوة خاصة في مهام تصحيح الأخطاء وتحليل الأسباب الجذرية الصعبة." وقال صوالح آصف، المؤسس المشارك لشركة Cursor، إن النموذج يقدم "ذكاءً قريبًا من Fable 5 وبسرعة وتكلفة Opus".

أفاد Wade Foster، الرئيس التنفيذي لشركة Zapier، أن Opus 5 "تصدر قائمة صدارة Zapier's AutomationBench دون إنفاق المزيد من الرموز المميزة مقارنة بنماذج Claude السابقة،" حيث أكمل سير عمل كامل لمنع التباطؤ من البداية إلى النهاية - وضع علامة على الحسابات المعرضة للخطر، وتنبيه المالك المناسب، وتلخيص لفرق الاحتفاظ. النماذج السابقة لم تمر. وصلت نسبة الـ Opus 5 إلى 100%.

مكاسب في البحث العلمي

سلط أنثروبيك الضوء أيضًا على تحسينات Opus 5 للعمل العلمي. يتفوق النموذج على Opus 4.8 في كل تقييم من تقييمات علوم الحياة التي تجريها الأنثروبيك، والتي تغطي البيولوجيا الهيكلية، والكيمياء العضوية، والمعلوماتية الحيوية. أشارت الشركة إلى تحسن قدره 10.2 نقطة مئوية في معيار الكيمياء العضوية الداخلي (استنتاج الهياكل الجزيئية من بيانات التحليل الطيفي)، وزيادة قدرها 7.7 نقطة في مهام التنبؤ بوظيفة البروتين. وصف أحد عملاء علم الجينوم النموذج بأنه يتصرف "مثل عالم دقيق"، حيث يصل إلى الاختبارات الإحصائية الصحيحة ويتحقق من نتائجه.

استراتيجية التسعير

من خلال تسعير Opus 5 بنفس مستوى Opus 4.8 مع الاقتراب من ذكاء Fable 5، تعمل Anthropic بشكل فعال على تضييق الفجوة بين عروضها المتوسطة والرائدة. صاغ VentureBeat الإصدار باعتباره "نموذجًا أرخص للذكاء الاصطناعي للبرمجة والوكلاء وسير عمل المؤسسات"، ولاحظ موقع Seeking Alpha أن Opus 5 "أقرب وأرخص من النموذج الحدودي Fable 5." تقدم الشركة إعداد "الجهد" القابل للتعديل الذي يتيح للعملاء تبادل المعلومات من أجل السرعة وخفض تكاليف الرمز المميز، وضبط نسبة التكلفة إلى الأداء لكل مهمة.

ماذا يعني بالنسبة لسباق الذكاء الاصطناعي

يسلط Opus 5 الضوء على مدى سرعة انخفاض تكلفة الذكاء الاصطناعي القريب من الحدود. النموذج الذي يأتي على مسافة قريبة من الأنظمة الأكثر قدرة المتاحة - بنصف سعر الرمز المميز - يضغط على المنافسين لتبرير التسعير المتميز لتحقيق مكاسب هامشية. ومع تسابق شركات Anthropic وOpenAI وGoogle وغيرها لجعل النماذج القادرة ميسورة التكلفة بما يكفي للنشر اليومي على نطاق واسع، فإن السؤال المطروح على المؤسسات يتحول من "أي نموذج هو الأكثر ذكاءً؟" إلى "ما النموذج الذي يقدم أكبر قدر من الذكاء لكل دولار؟"

بالنسبة لشركة أنثروبيك، الرسالة واضحة: لم يعد التفكير الراقي منتجًا فاخرًا. تعمل Opus 5 على جلب القدرة على الحدود المجاورة إلى نقطة سعر تجعل النشر اليومي المستدام واقعيًا - وقد يكون هذا هو التفاصيل الأكثر أهمية على الإطلاق.

ابق في صدارة الذكاء الاصطناعي

يتوفر Claude Opus 5 بدءًا من اليوم على Claude Pro وClaude Max وعبر Anthropic's API. لمعرفة المزيد عن هذه القصة والمشهد الأوسع للذكاء الاصطناعي، تابع أخبار الذكاء الاصطناعي العاجلة فور حدوثها.

اقرأ المزيد من أخبار الذكاء الاصطناعي →