أصدرت Anthropic Claude Sonnet 5، واصفة إياه بأنه النموذج الأكثر وكيلًا من فئة Sonnet الذي بنته الشركة. تم الكشف عن النموذج الجديد في 30 يونيو 2026، ويمكنه وضع الخطط، واستخدام أدوات مثل المتصفحات والمحطات الطرفية، وتشغيله بشكل مستقل على مستوى كان يتطلب، قبل بضعة أشهر فقط، نماذج أكبر وأكثر تكلفة بكثير. ويأتي الإطلاق في وقت تتسابق فيه صناعة الذكاء الاصطناعي بأكملها لتحويل روبوتات الدردشة إلى عملاء قادرين يمكنهم التصرف نيابة عن المستخدم بدلاً من مجرد الإجابة على الأسئلة.

بالنسبة للمطورين الذين يتتبعون آخر التطورات، تضيف الأخبار إلى سلسلة مزدحمة من أخبار الذكاء الاصطناعي العاجلة التي أعادت تشكيل المشهد التنافسي. الإطارات الإنسانية Sonnet 5 هي اللحظة التي تصل فيها القدرة الوكيلة أخيرًا إلى أسعار الطبقة المتوسطة، وهو تحول يمكن أن يغير كيفية ميزانية الفرق لسير العمل المستقل.

الأداء الذي ينافس الرائد

وفقًا لـ Anthropic، يعمل Sonnet 5 على تضييق الفجوة بين خط Sonnet متوسط المدى ونماذج Opus عالية المستوى للشركة. أداءه قريب من أداء Opus 4.8 ، ولكن بأسعار أقل بكثير، ويمثل تحسنًا ملحوظًا عن سابقه، Sonnet 4.6، في التفكير واستخدام الأدوات والترميز والعمل المعرفي.

منحنيات أداء التكلفة المنشورة من قبل الإنسان والتي تقارن النموذج مع Sonnet 4.6 وOpus 4.8 في تقييمين للوكلاء: BrowseComp، الذي يقيس البحث الوكيل، وOSWorld-Verified، الذي يختبر استخدام الكمبيوتر. وتقول الشركة إن Sonnet 5 يقدم نطاقًا أوسع من خيارات أداء التكلفة مقارنة بـ Sonnet 4.6، وبمستويات جهد أعلى، يمكنه مطابقة Opus 4.8 في بعض المهام.

التسعير العدواني للوكلاء

التسعير أمر أساسي في الملعب. يتم إطلاق Claude Sonnet 5 مع سعر تمهيدي قدره 2 دولار لكل مليون رمز إدخال و10 دولارات لكل مليون رمز مميز للمخرج، وهو متاح حتى 31 أغسطس 2026. وبعد هذه النافذة، ينتقل السعر إلى 3 دولارات لكل مليون رمز مميز للإدخال و15 دولارًا لكل مليون رمز مميز للمخرج.

للمقارنة، يبلغ سعر Opus 4.8 5 دولارات لكل مليون رمز إدخال و25 دولارًا لكل مليون رمز إخراج. ونظرًا لأن الوكلاء يحرقون أعدادًا كبيرة من الرموز المميزة أثناء تفكيرهم واستدعاء الأدوات عبر العديد من الخطوات، فإن فجوة السعر هذه لها أهمية كبيرة بالنسبة لميزانيات المؤسسات. وصف مختبرو الوصول المبكر الذين استشهد بهم Anthropic أن Sonnet 5 ينهي المهام المعقدة حيث تتوقف نماذج Sonnet السابقة عن العمل، وتتحقق من مخرجاتها دون أن يُطلب منها ذلك صراحة.

التوفر في كل خطة

يتوفر Claude Sonnet 5 في جميع خطط Anthropic منذ يوم الإطلاق. إنه النموذج الافتراضي لمستخدمي Free وPro، وهو متاح لعملاء Max وTeam وEnterprise. يمكن للمطورين الوصول إليه من خلال واجهة برمجة تطبيقات Claude باستخدام معرف النموذج "كلود-سونيت-5"، وكذلك من خلال كلود كود ومنصة كلود.

يعد الطرح الواسع النطاق ملحوظًا لأنه يضع الأداء الفعال في أيدي المستخدمين المجانيين، وليس فقط عملاء المؤسسات الذين يدفعون. قال Anthropic إن خط Sonnet كان تاريخيًا حيث بدأ عصر الوكلاء للعديد من المطورين، مشيرًا إلى Claude Sonnet 3.5 و3.6 و3.7 كنماذج أولى أظهرت مهارات قوية في البرمجة واستخدام الأدوات.

قصة سلامة مدمجة

كانت السلامة جزءًا رئيسيًا من الإعلان. وقالت Anthropic إن تقييماتها وجدت أن Sonnet 5 يُظهر معدلًا إجماليًا أقل للسلوكيات غير المرغوب فيها مقارنةً بـ Sonnet 4.6 وهو أكثر أمانًا بشكل عام للاستخدام في السياقات الوكيلة. وأشارت الشركة أيضًا إلى أن النموذج يتمتع بقدرة أقل بكثير على أداء مهام الأمن السيبراني مقارنة بنماذج Opus الحالية، وهو اختيار تصميم متعمد يقلل من مخاطر سوء الاستخدام حتى مع ارتفاع القدرات العامة.

تُقدم بطاقة نظام Claude Sonnet 5، التي تم إصدارها جنبًا إلى جنب مع النموذج، مجموعة واسعة من التقييمات بالتفصيل. لقد وضعت أنثروبيك الشفافية حول اختبارات السلامة كأداة تمييز تنافسية حيث يقوم المنظمون في الولايات المتحدة وأوروبا بتدقيق إصدارات النماذج الحدودية.

اللحظة الفاعلية الأوسع

يتم الإطلاق وسط منافسة شديدة. ويتجه المنافسون، بما في ذلك OpenAI، وGoogle، ومجموعة سريعة الحركة من المختبرات الصينية، نحو نماذج يمكنها اتخاذ إجراءات متعددة الخطوات بدلاً من مجرد إنشاء نص. من خلال تقديم قدرة وكيل مجاورة لـ Opus بأسعار Sonnet، تراهن Anthropic على أن ساحة المعركة التالية ليست نتائج قياسية أولية، بل تكلفة تشغيل الوكيل بشكل موثوق خلال مهام طويلة ومعقدة.

مع إغلاق الأسعار التمهيدية حتى نهاية أغسطس، أصبح لدى المطورين الآن نافذة لاختبار الضغط على Sonnet 5 في مواجهة أحمال عمل الوكلاء الأكثر تطلبًا قبل أن تدخل المعدلات الأعلى حيز التنفيذ.

ابق في صدارة الذكاء الاصطناعي

لا تظهر وتيرة إصدارات النماذج أي علامة على التباطؤ. للحصول على تغطية مستمرة لعمليات الإطلاق الجديدة وجولات التمويل والتحولات في السياسات، تفضل بزيارة AI Buzz Wire للاطلاع على أحدث تطورات الذكاء الاصطناعي فور حدوثها.

اقرأ المزيد من أخبار الذكاء الاصطناعي →