أطلقت شركة الذكاء الاصطناعي الأوروبية Multiverse Computing نموذج Quasar 438B، وهو نموذج منطقي كبير تقول الشركة إنه نموذج الذكاء الاصطناعي الأكثر ذكاءً في أوروبا. وفقًا لإعلان الشركة، حصل Quasar 438B على 43 نقطة في مؤشر ذكاء التحليل الاصطناعي، وهي أعلى نتيجة لأي نموذج أوروبي تم قياسه وفقًا لهذا المعيار.

يمثل الإطلاق خطوة مهمة للشركة الإسبانية، التي بنت سمعتها على ضغط نماذج الذكاء الاصطناعي بدلاً من تدريب الأنظمة ذات النطاق الحدودي. Quasar 438B هو أول نموذج كبير أطلقته شركة Multiverse Computing، ويأتي في الوقت الذي تضغط فيه الحكومات والشركات الأوروبية من أجل قدرات الذكاء الاصطناعي التي لا تعتمد بالكامل على المختبرات الأمريكية والصينية. بالنسبة للقراء الذين يتابعون تغطيتنا الإخبارية للذكاء الاصطناعي، يشير الإصدار أيضًا إلى أن السباق لسد الفجوة مع النماذج الرائدة لم يعد يقتصر على المتنافسين الأمريكيين المعتادين.

ما الذي سجله Quasar 438B فعليًا

يجمع مؤشر ذكاء التحليل الاصطناعي (الإصدار 4.1.1) بين تسعة تقييمات، بما في ذلك إجمالي الناتج المحلي الإجمالي (GDVval-AA v2)، وtau3-Banking، وTerminal-Bench v2.1، وSciCode، وHumanity's Last Exam، وGPQA Diamond، وCritPt، وAA-Omniscience، وAA-LCR. النتيجة المركبة لـ Quasar 438B البالغة 43 تضعه في المقدمة على Mistral Medium 3.5 عند 30، وNVIDIA's Nemotron 3 Ultra عند 38، وInkling عند 42، وفقًا لإعلان الشركة.

ولا يزال المجال الأوسع ينتمي إلى الحدود الأمريكية: حيث يتصدر كلود أوبوس 5 المؤشر عند 63. ولا تدعي شركة حوسبة الكون المتعدد خلاف ذلك. وبدلاً من ذلك، قامت الشركة بتأطير Quasar 438B باعتباره الخيار الأوروبي الأقوى، متفوقًا على النماذج الأوروبية المماثلة في سبعة من تقييمات التحليل الاصطناعي الثمانية المحددة التي أبرزتها.

السرعة هي الحجة الثانية

إن النتائج المعيارية الأولية ليست سوى نصف عرض Multiverse Computing. تقول الشركة إن Quasar 438B يعيد 500 رمزًا، بما في ذلك وقت التفكير، في 15.3 ثانية. من بين النماذج التي تمت مقارنتها، فقط Nemotron 3.5 Lightning (9.4 ثانية)، وGemini 3.5 Flash-Lite (10.8 ثانية) وGemini 3.7 Flash (11.5 ثانية) هي الأسرع، وفقط Gemini 3.7 Flash هو الأسرع والأكثر قدرة على الفهرس.

تجري المقارنة مع Mistral Medium 3.5 في اتجاه واحد على كلا المحورين: يسجل Quasar أعلى (43 مقابل 30) ويستجيب بشكل أسرع (15.3 ثانية مقابل 18.8 ثانية). يحتاج Inkling، الذي يطابق تقريبًا ذكاء Quasar عند 42، إلى 48.3 ثانية لنفس الاستجابة المكونة من 500 رمز، أي أكثر من ثلاثة أضعاف المدة.

الاستدلال القوي طويل السياق

تبرز إحدى النتائج من هذا الإعلان: في التقييم AA-LCR، الذي يختبر القدرة على استخراج المعلومات المنتشرة عبر المستندات الطويلة وتوصيلها واستدلالها، حصل Quasar 438B على 75.0. وهذا هو المستوى مع Grok 4.6 (عالي)، ضمن نقطة واحدة من Claude Opus 5 عند 75.7، وقبل Qwen3.8 2.4T A95B عند 75.3، وفقًا لأرقام الشركة.

يعد التعامل مع السياق الطويل أمرًا مهمًا نظرًا لأن أبحاث المؤسسات وتحليل المستندات وسير العمل الوكيل مبنية عليها. إذا لم يتمكن النموذج من الاحتفاظ بالمعلومات وتوصيلها عبر مستند طويل، فلن يتمكن من تشغيل الأدوات متعددة الخطوات التي ترغب الشركات في نشرها بالفعل. هذا هو المكان الذي يقترب فيه Quasar من المجموعة الحدودية.

لا يزال لدى برمجة الوكيل مساحة كبيرة

أضعف نتيجة في الإعلان هي Terminal-Bench v2.1، الذي يضع وكلاء التشفير للعمل في بيئات طرفية حقيقية. حصل Quasar 438B على 69.3 نقطة، متفوقًا على Mistral Medium 3.5 بـ 18.7 نقطة وNemotron 3 Ultra بـ 15.4، لكنه يتخلف عن المجموعة الحدودية التي يقودها Claude Opus 5 بـ 89.1. تقر شركة Multiverse Computing بأن هذا هو التقييم الذي يتمتع بأكبر قدر من الإرتفاع وتقول إن الجولة التالية من العمل تستهدف هذا التقييم.

مصمم لوكلاء المؤسسات

تم وضع Quasar 438B كنموذج للمؤسسات التي تدير وكلاء تطوير البرمجيات، ومساعدي الطيارين الفنيين، وأنظمة البحث، وأتمتة سير العمل. إنه موجود في فئة تضم أكثر من 400 مليار معلمة، ويتعامل مع اللغتين الإنجليزية والإسبانية، وهو مصمم للمهام متعددة الخطوات التي تحتاج إلى التخطيط واستخدام الأدوات وتنفيذ التعليمات البرمجية وسياق كبير دون الكمون الذي يحمله الفصل عادةً.

يتم تشغيل الوصول من خلال واجهة برمجة تطبيقات CompactifAI الخاصة بالشركة، بحيث يمكن للفرق اختبار النموذج دون الحاجة إلى دعم البنية التحتية الخاصة بهم. تقول شركة Multiverse Computing أن المزيد من التحديثات قادمة لـ Quasar.

ماذا يعني ذلك بالنسبة لسباق الذكاء الاصطناعي الأوروبي

يأتي الإصدار في لحظة غريبة بالنسبة للذكاء الاصطناعي الأوروبي. وقد واجهت ميسترال، التي ظلت لفترة طويلة حاملة لواء القارة، تساؤلات حول اتجاهها، في حين عززت المختبرات الأمريكية تقدمها في المعايير المركبة. إن النموذج الأوروبي الذي يتصدر المجال الأوروبي بشكل شرعي على مؤشر مستقل يمنح الشركات في القارة خياراً إقليمياً ذا مصداقية، وخاصة بالنسبة لعمليات النشر ثنائية اللغة الإنجليزية والإسبانية.

أما ما إذا كان Quasar 438B يحتفظ بهذا المنصب، فهذه مسألة أخرى. وتشير الشركة نفسها إلى أن جزءًا صغيرًا فقط من الشركات الرائدة في المؤشر يجيب بشكل أسرع، ولا تزال الفجوة بين كلود أوبوس 5 واسعة بمقدار عشرين نقطة. ولكن الشركة التي تعتمد مبدأ الضغط أولاً أظهرت الآن قدرتها على المنافسة في فئة الوزن الثقيل، وأصبح لدى الشركات الأوروبية أخيراً نموذج للسوق المحلية يستحق المقارنة مع حالات التخلف عن السداد في الولايات المتحدة.

ابق في صدارة الذكاء الاصطناعي

يتغير مشهد الذكاء الاصطناعي كل ساعة، وتختفي الخيوط القياسية التي بدت منيعة في يناير بحلول الصيف. اقرأ المزيد من أخبار الذكاء الاصطناعي على AI Buzz Wire لتتبع كل إصدار للنموذج والنتيجة المعيارية والتحول في السياسة فور حدوثه.

تابع أحدث تطورات الذكاء الاصطناعي هنا.