یورپی AI کمپنی ملٹیورس کمپیوٹنگ نے Quasar 438B لانچ کیا ہے، ایک بڑا ریجننگ ماڈل جس کے بارے میں کمپنی کا کہنا ہے کہ یورپ میں بنایا گیا سب سے ذہین AI ماڈل ہے۔ کمپنی کے اعلان کے مطابق، Quasar 438B نے مصنوعی تجزیہ انٹیلی جنس انڈیکس پر 43 اسکور کیے، جو اس بینچ مارک پر ماپا جانے والے کسی بھی یورپی ماڈل کا سب سے زیادہ نتیجہ ہے۔

لانچ ہسپانوی فرم کے لیے ایک اہم قدم کی نشاندہی کرتا ہے، جس نے فرنٹیئر اسکیل سسٹم کی تربیت کے بجائے AI ماڈل کمپریشن پر اپنی ساکھ بنائی۔ Quasar 438B پہلا بڑا ماڈل ہے جو ملٹیورس کمپیوٹنگ نے جاری کیا ہے، اور یہ اس وقت آیا جب یورپی حکومتیں اور کمپنیاں AI کی صلاحیت کے لیے زور دے رہی ہیں جو مکمل طور پر امریکی اور چینی لیبز پر منحصر نہیں ہے۔ ہماری AI نیوز کوریج کو فالو کرنے والے قارئین کے لیے، ریلیز اس بات کا اشارہ بھی دیتی ہے کہ فرنٹیئر ماڈلز کے ساتھ خلا کو ختم کرنے کی دوڑ اب عام امریکی دعویداروں تک محدود نہیں رہی۔

Quasar 438B اصل میں کیا اسکور کرتا ہے۔

مصنوعی تجزیہ انٹیلی جنس انڈیکس (ورژن 4.1.1) نو تشخیصات کو یکجا کرتا ہے، بشمول GDPval-AA v2، tau3-Banking، Terminal-Bench v2.1، SciCode، Humanity's Last Exam، GPQA Diamond، CritPt، AA-AA-Amniscience اور۔ کمپنی کے اعلان کے مطابق Quasar 438B کا 43 کا جامع سکور اسے Mistral Medium 3.5 سے 30 پر، NVIDIA کے Nemotron 3 Ultra کو 38 پر، اور Inkling کو 42 پر رکھتا ہے۔

وسیع میدان اب بھی امریکی سرحد سے تعلق رکھتا ہے: کلاڈ اوپس 5 انڈیکس میں 63 پر آگے ہے۔ ملٹیورس کمپیوٹنگ دوسری صورت میں دعوی نہیں کرتی ہے۔ اس کے بجائے، کمپنی Quasar 438B کو مضبوط ترین یورپی آپشن کے طور پر تیار کرتی ہے، جو اس نے نمایاں کیے گئے آٹھ منتخب مصنوعی تجزیہ تشخیص میں سے سات میں موازنہ یورپی ماڈلز کو پیچھے چھوڑ دیا۔

رفتار دوسری دلیل ہے۔

خام بینچ مارک اسکور ملٹیورس کمپیوٹنگ کی پچ کا صرف نصف ہیں۔ کمپنی کا کہنا ہے کہ Quasar 438B 500 ٹوکن واپس کرتا ہے، سوچنے کا وقت بھی شامل ہے، 15.3 سیکنڈ میں۔ اس کے مقابلے میں ماڈلز میں، صرف Nemotron 3.5 Lightning (9.4 سیکنڈز)، Gemini 3.5 Flash-Lite (10.8 سیکنڈ) اور Gemini 3.7 Flash (11.5 سیکنڈز) تیز ہیں، اور صرف Gemini 3.7 Flash انڈیکس پر تیز اور زیادہ قابل ہے۔

Mistral Medium 3.5 کے خلاف موازنہ دونوں محوروں پر ایک طرفہ چلتا ہے: Quasar اسکور زیادہ (30 کے مقابلے 43) اور تیز جواب دیتا ہے (18.8 سیکنڈ کے مقابلے میں 15.3 سیکنڈ)۔ انکلنگ، جو تقریباً 42 پر Quasar کی ذہانت سے مماثلت رکھتی ہے، اسی 500 ٹوکن جواب کے لیے 48.3 سیکنڈز کی ضرورت ہے، جو اس سے تین گنا زیادہ طویل ہے۔

مضبوط طویل سیاق و سباق کی استدلال

اعلان سے ایک نتیجہ نکلتا ہے: AA-LCR پر، وہ تشخیص جو طویل دستاویزات میں پھیلی ہوئی معلومات کو نکالنے، جڑنے اور اس پر استدلال کرنے کی صلاحیت کی جانچ کرتی ہے، Quasar 438B کا اسکور 75.0 ہے۔ کمپنی کے اعداد و شمار کے مطابق، یہ گروک 4.6 (اونچی) کے ساتھ، Claude Opus 5 کے ایک پوائنٹ کے اندر 75.7 پر، اور Qwen3.8 2.4T A95B سے 75.3 پر آگے، کمپنی کے اعداد و شمار کے مطابق۔

طویل سیاق و سباق سے نمٹنے کے معاملات کیوں کہ انٹرپرائز ریسرچ، دستاویزات کا تجزیہ اور ایجنٹ ورک فلو اس پر بنتے ہیں۔ اگر ایک ماڈل ایک طویل دستاویز میں معلومات کو نہیں رکھ سکتا اور جوڑ نہیں سکتا، تو یہ ان ملٹی سٹیپ ٹولز کو طاقت نہیں دے سکتا جو کمپنیاں اصل میں تعینات کرنا چاہتی ہیں۔ یہ وہ جگہ ہے جہاں کوسر فرنٹیئر گروپ کے سب سے قریب آتا ہے۔

ایجنٹی کوڈنگ میں ابھی بھی ہیڈ روم ہے۔

اعلان میں سب سے کمزور نتیجہ Terminal-Bench v2.1 ہے، جو کوڈنگ ایجنٹوں کو حقیقی ٹرمینل ماحول میں کام کرنے کے لیے رکھتا ہے۔ Quasar 438B اسکور 69.3، Mistral Medium کو 18.7 پوائنٹس سے 3.5 اور Nemotron 3 Ultra کو 15.4 سے آگے، لیکن Claude Opus 5 کی قیادت میں فرنٹیئر گروپ سے 89.1 پر پیچھے ہے۔ ملٹیورس کمپیوٹنگ تسلیم کرتا ہے کہ یہ سب سے زیادہ ہیڈ روم کے ساتھ تشخیص ہے اور کہتا ہے کہ کام کے اگلے دور کا مقصد اس پر ہے۔

انٹرپرائز ایجنٹس کے لیے بنایا گیا ہے۔

Quasar 438B سافٹ ویئر ڈویلپمنٹ ایجنٹس، ٹیکنیکل کاپیلٹس، ریسرچ سسٹم اور ورک فلو آٹومیشن چلانے والی تنظیموں کے لیے ایک ماڈل کے طور پر پوزیشن میں ہے۔ یہ 400-بلین پیرامیٹر پلس کلاس میں بیٹھتا ہے، انگریزی اور ہسپانوی کو ہینڈل کرتا ہے، اور اس کو کثیر مرحلہ وار کاموں کے لیے ڈیزائن کیا گیا ہے جن کے لیے منصوبہ بندی، ٹول کے استعمال، کوڈ پر عمل درآمد اور بڑے سیاق و سباق کی ضرورت ہوتی ہے اس تاخیر کے بغیر جو کلاس عام طور پر رکھتی ہے۔

رسائی کمپنی کے CompactifAI API کے ذریعے چلتی ہے، لہذا ٹیمیں اپنے بنیادی ڈھانچے کو کھڑے کیے بغیر ماڈل کی جانچ کر سکتی ہیں۔ Multiverse Computing کا کہنا ہے کہ Quasar کے لیے مزید اپ ڈیٹس آ رہے ہیں۔

یورپی AI ریس کے لیے اس کا کیا مطلب ہے۔

ریلیز یورپی AI کے لیے ایک خاص لمحے پر اترتی ہے۔ Mistral، طویل عرصے سے براعظم کے معیاری علمبردار، کو اپنی سمت کے بارے میں سوالات کا سامنا کرنا پڑا ہے، جبکہ امریکی لیبز نے جامع بینچ مارکس پر اپنی برتری کو مستحکم کیا ہے۔ ایک یورپی ماڈل جو قانونی طور پر یورپی فیلڈ میں ایک آزاد انڈیکس میں سرفہرست ہے براعظم کے کاروباری اداروں کو ایک قابل اعتبار علاقائی آپشن فراہم کرتا ہے، خاص طور پر دو لسانی انگریزی-ہسپانوی تعیناتیوں کے لیے۔

Quasar 438B اس پوزیشن پر ہے یا نہیں یہ ایک اور معاملہ ہے۔ کمپنی خود نوٹ کرتی ہے کہ انڈیکس لیڈرز کا صرف ایک حصہ تیزی سے جواب دیتا ہے، اور Claude Opus 5 کا فرق بیس پوائنٹس چوڑا ہے۔ لیکن کمپریشن فرسٹ کمپنی نے اب دکھایا ہے کہ وہ ہیوی ویٹ کلاس میں مقابلہ کر سکتی ہے، اور یورپی اداروں کے پاس آخر کار گھریلو مارکیٹ کا ماڈل ہے جو ان کے امریکی ڈیفالٹس کے خلاف بینچ مارکنگ کے قابل ہے۔

AI سے آگے رہیں

AI زمین کی تزئین کی تبدیلی گھنٹے کے ساتھ ہوتی ہے، اور بینچ مارک لیڈز جو جنوری میں ناقابل رسائی نظر آتے تھے گرمیوں میں ختم ہو جاتے ہیں۔ AI Buzz Wire پر مزید AI خبریں پڑھیں ہر ماڈل کی ریلیز، بینچ مارک کے نتیجے اور پالیسی میں تبدیلی جیسے ہی ہوتا ہے۔

یہاں AI کی تازہ ترین پیشرفت کی پیروی کریں۔