أصدرت شركة xAI برنامج Grok 4.6، وهو أحدث إصدار لنموذج اللغة الكبير الحدودي الخاص بها، حيث سجلت 61 نقطة في مؤشر ذكاء التحليل الاصطناعي لتتناسب مع GPT-5.6 Sol الخاص بشركة OpenAI. تم إطلاق النموذج اليوم وهو متاح على الفور في Cursor وGrok Build، مع إمكانية الوصول إلى واجهة برمجة التطبيقات وتكاملات الشركاء من خلال OpenRouter وVercel وCloudflare.
للحصول على أحدث الأخبار والتحليلات العاجلة حول الذكاء الاصطناعي، تفضل بزيارة AI Buzz Wire.
استخبارات الحدود بجزء بسيط من التكلفة
وفقًا للتحليل الاصطناعي، وهي منصة قياس مرجعية مستقلة، حصل Grok 4.6 على خمس نقاط مقارنة بسابقه Grok 4.5 في مؤشر الذكاء، مما يعيد xAI إلى المستوى الحدودي جنبًا إلى جنب مع OpenAI. يقع النموذج خلف Claude Opus 5 من Anthropic (63) وClaude Fable 5 (62)، وقبل Kimi K3.
ما يجعل Grok 4.6 ملحوظًا بشكل خاص هو سعره. يظل السعر الرئيسي دون تغيير عن Grok 4.5 عند 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج. وهذا يجعلها أقل بنسبة 60٪ من Claude Opus 5 (5 دولارات / 25 دولارًا) وGPT-5.6 Sol (5 دولارات / 30 دولارًا). التكلفة المقاسة لكل مهمة هي 0.84 USD، مما يضعها على حدود الذكاء مقابل تكلفة باريتو.
إن إبقاء الأسعار ثابتة على مدى جيل هو أمر غير معتاد على الحدود، حيث كانت المكاسب الاستخباراتية مصحوبة عادة بزيادات في الأسعار. يوفر Grok 4.6 مكاسب لمؤشر الذكاء من خمس نقاط بأسعار دون تغيير.
مصمم للوكلاء الذين يعملون لفترة طويلة
يعتمد Grok 4.6 على Grok 4.5 مع ما تصفه xAI بأنه تركيز خاص على الوكلاء طويلي الأمد والعمل التفاعلي والمرئي الأكثر طموحًا. تقول الشركة إن النموذج يظل مزودًا بمهام معقدة عبر العديد من الخطوات، سواء البحث في موضوع ما، أو تحليل المعلومات، أو العمل عبر قاعدة تعليمات برمجية، أو تحويل فكرة إلى تطبيق مصقول.
تحكي المعايير الوكيلة قصة مقنعة. في الناتج المحلي الإجمالي (GDVval-AA v2)، وهو مقياس رائد للعمل المعرفي الفاعل في العالم الحقيقي، حقق Grok 4.6 إيلو 1753، خلف كلود أوبوس 5 فقط وعلى قدم المساواة إحصائيًا مع كلود فابل 5 وQwen3.8 ماكس. لقد حصل على 50.7% على معيار tau-cubed للخدمات المصرفية لخدمة العملاء متعددة المنعطفات، مما يضعه في المركزين الأول والثاني إلى جانب Qwen3.8 Max.
في CursorBench v3.2، حصل Grok 4.6 على 69.9%، متقدمًا على كل من GPT-5.6 Sol (67.2%) وGrok 4.5 (66.7%). لقد سجلت 65.9% على DeepSWE v1.1 و61.3% على FrontierCode v1.1 Extended.
كفاءة دوران رائعة
أحد النتائج البارزة للتحليل الاصطناعي هو ملف تعريف كفاءة Grok 4.6 في AA-Briefcase، وهو معيار خاص لمهام العمل المعرفية الوكيلة طويلة المدى. ظهر النموذج لأول مرة مع Elo عام 1577، ووضعه في فئة Fable 5.
أرقام الكفاءة مذهلة. يقوم Grok 4.6 بحل المهام في حوالي 53 دورة و0.5 مليار رمز إدخال في المتوسط، مقارنة بحوالي 103 دورة و2.0 مليار رمز إدخال لـ Claude Opus 5 max. نظرًا لأن العمل الوكيل طويل الأفق يتراكم السياق بسرعة، فإن النموذج الذي يصل إلى إجابة قابلة للمقارنة في نصف الدورات وربع الرموز المميزة للإدخال يتمتع بميزة التكلفة تتجاوز بكثير تسعيره لكل رمز مميز.
التدريب والسلامة
خضع Grok 4.6 لتدريب تكميلي أطول من Grok 4.5، مع بيانات منسقة تم إنشاؤها بواسطة النموذج للاستدلال والمفاهيم التقنية المتقدمة، وبيانات هندسية عالية الجودة، ومُحسِّن وصفة تدريب. استخدمت xAI برنامج Grok 4.5 لتجديد مسارات SFT عبر جهود الاستدلال وأدوات الوكلاء والمجالات بما في ذلك العلوم والتكنولوجيا والهندسة والرياضيات (STEM) وهندسة البرمجيات والعمل المعرفي.
يحمل النموذج نافذة سياق مكونة من 500000 رمز، دون تغيير عن Grok 4.5. تفيد تقارير xAI أن Grok 4.6 خضع لأكبر مجموعة على الإطلاق من اختبارات ما قبل النشر للقدرات ومعايرة الحماية، إلى جانب اختبارات ما بعد النشر المكثفة واختبارات الجهات الخارجية.
التوفر والتسعير
يتوفر Grok 4.6 اليوم في Cursor وGrok Build. تقدم xAI استخدامًا مزدوجًا مضمنًا داخل كلا النظامين الأساسيين للأسبوع الأول. يبدأ السعر بـ 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج، مع توفر متغير سريع بضعف السعر. يتم خصم نتائج ذاكرة التخزين المؤقت إلى 0.50 دولارًا أمريكيًا لكل مليون رمز مميز.
يستمر الإصدار في الإيقاع السريع لـ xAI، مع وصول Grok 4.6 بعد أكثر من شهر بقليل من Grok 4.5. يضع النموذج xAI كمنافس جدي في السباق الحدودي، خاصة بالنسبة للمطورين الذين يمنحون الأولوية للأداء الوكيل وكفاءة التكلفة.
البقاء في صدارة الذكاء الاصطناعي
للحصول على تغطية مستمرة لأهم التطورات في مجال الذكاء الاصطناعي، ضع إشارة مرجعية على AI Buzz Wire ولا تفوت أي قصة عاجلة.
اقرأ المزيد من أخبار الذكاء الاصطناعي