أصدرت شركة xAI إصدار Grok 4.7، وهو النموذج الأكثر قدرة للشركة في مجال البرمجة والمعرفة حتى الآن، بعد أسابيع من التشويق العام وتأخير واحد على الأقل. تم الإعلان عن النموذج على موقع الشركة يوم الأحد، بنفس السعر وسرعة الخدمة مثل سابقه Grok 4.6: 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج، أي ما يقرب من نصف سعر قائمة OpenAI's GPT-5.6 Sol Max (4 دولارات / 20 دولارًا) وأقل بكثير من Anthropic's Fable 5.1 Max (10 دولارات / 50 دولارًا).

للحصول على أحدث الأخبار والتحليلات العاجلة حول الذكاء الاصطناعي، تفضل بزيارة AI Buzz Wire.

نموذج أساسي أكبر حجمًا، تم تدريبه على المهام الطويلة

وفقًا لإعلان xAI، يستخدم Grok 4.7 نموذجًا أساسيًا جديدًا أكبر مقارنةً بـ Grok 4.6 وتم تدريبه باستخدام التعلم المعزز الأطول الذي يتم تشغيله على مزيج أصعب من المهام، مع التركيز على المشكلات التي تستغرق عدة ساعات لإكمالها. تقول الشركة إن النموذج أفضل في التحقق من عمله وإدارة السياق الأطول، وأنه تم تدريبه لفهم أداة Grok Bot بشكل أصلي، مما يحسن مهام المحادثة وعمل المعرفة العامة.

يأتي الإصدار بعد فترة تشغيل صاخبة. قال إيلون موسك لأول مرة في أوائل سبتمبر إن Grok 4.7 سيهبط في غضون عشرة أيام، ثم اعترف في منتصف سبتمبر بأن النموذج يحتاج إلى بضعة أيام أخرى من التحسين، وفقًا لموقع TeslaNorth.com. يتم الآن شحنه، وأكد GitHub في نفس اليوم أن Grok 4.7 متوفر في GitHub Copilot.

الصورة المعيارية: قوية وليست كاسحة

تُظهر البيانات المعيارية التي نشرتها xAI نموذجًا يتصدر العديد من الفئات ذات الأفق الطويل بينما يظل متخلفًا عن أغلى تكوينات Anthropic على الآخرين:

  • CursorBench 4.0، الذي يركز على مهام البرمجة طويلة الأمد: حصل Grok 4.7 على 46.3%، متقدمًا على GPT-5.6 Sol Max (41.7%) وGrok 4.6 High (40.4%)، ولكن خلف Fable 5.1 Max (51.8%).
  • Terminal-Bench 4.0، العمل النهائي لعدة ساعات: 38.0%، ارتفاعًا حادًا من 20.3% لـ Grok 4.6 ومتقدمًا مباشرةً على GPT-5.6 Sol Max (37.3%)، على الرغم من أن Fable 5.1 Max يتقدم بنسبة 57.9%.
  • EEBench، معيار الهندسة الكهربائية: 64.0%، وهي قفزة كبيرة من Grok 4.6's 53.0% وأعلى النماذج المدرجة.
  • DeepSWE v1.1: 71.0% في الجهد العالي، مقابل 65.2% في Grok 4.6 و72.7% في GPT-5.6 Sol Max.
  • حقيبة AA v1.1، العمل المكتبي لعدة ساعات: 1,657، ارتفاعًا من 1,546، ويقترب من Fable 5.1 Max عند 1,678.
  • مؤشر Harvey Legal Agent Benchmark: 19.6%، متقدمًا على Grok 4.6 (15.8%) ومتقدمًا بفارق كبير عن GPT-5.6 Sol Max (2.5%) وFable 5.1 Max (6.7%) في هذا المقياس.
  • HealthBench Professional: 56.7%، متفوقًا على Grok 4.6's 48.5% لكنه متأخر عن GPT-5.6 Sol Max (60.5%) وFable 5.1 Max (62.1%).

في مؤشر الناتج المحلي الإجمالي (GDVval)، وهو معيار العمل المعرفي المهني الذي سجله Elo، يضع مخطط xAI مؤشر Grok 4.7 عند مستوى xhigh عند 1,695 - ارتفاعًا من 1,605 لـ Grok 4.6، خلف Fable 5.1 Max (1,735) وقبل GPT-6 Astra Max (1,542).

السعر هو القصة

الادعاء الأكثر عدوانية في الإعلان هو اقتصادي وليس تقني: تصف شركة xAI جهاز Grok 4.7 بأنه أسرع بمرتين بنصف سعر النماذج المماثلة، ويدعم جدول الأسعار المنشور المقارنة الرئيسية مع تكوينات المستوى الأعلى لمنافسيها الرئيسيين. لم يتغير سعر الرمز المميز لـ Grok 4.7 بقيمة 2 دولار/6 دولارات عن Grok 4.6، مما يعني أن المشترين يحصلون على تحسين جيل بعد جيل دون زيادة في الأسعار.

يمتد هذا الموضع إلى استراتيجية اتبعتها xAI عبر خط Grok 4.x: مطابقة الجودة الحدودية أو الاقتراب منها مع تقويض مستويات التسعير المتميزة لـ OpenAI وAnthropic، ثم التوزيع بقوة من خلال الشركاء بما في ذلك GitHub وCursor وOpenRouter.

ما يجب مشاهدته

التحذير الصادق هو أن xAI نشرت مخطط المقارنة نفسه، وسيستغرق التحقق المستقل من مجمعي المعايير أيامًا. فيما يتعلق بالأرقام التي اختارت xAI تسليط الضوء عليها، يعد Grok 4.7 خطوة حقيقية للأمام من Grok 4.6 - الأكثر وضوحًا في Terminal-Bench 4.0 وEEBench - لكنه لا يكتسح Fable 5.1 Max، الذي يحتفظ بالصدارة في معايير الترميز والصحة بينما يكلف خمسة أضعاف كل رمز إخراج.

بالنسبة للمطورين الذين يقومون بأعباء عمل وكيل طويلة ومتعددة الساعات، قد تكون حسابات السعر والأداء أكثر أهمية من موضع لوحة المتصدرين الأولية. يتوفر Grok 4.7 الآن من خلال واجهة برمجة تطبيقات xAI وفي GitHub Copilot.

البقاء في صدارة الذكاء الاصطناعي

للحصول على تغطية مستمرة لأهم التطورات في مجال الذكاء الاصطناعي، ضع إشارة مرجعية على AI Buzz Wire ولا تفوت أي قصة عاجلة.

اقرأ المزيد من أخبار الذكاء الاصطناعي