Cerebras Systems اور OpenAI نے Ultrafast Mode پر ایک ابتدائی نظر کا اشتراک کیا ہے، جو OpenAI API میں سب سے پہلے شروع ہونے والا ایک نیا سروس ٹیر ہے اور Cerebras wafer-scale ٹیکنالوجی کے ذریعے تقویت یافتہ ہے۔ شراکت داری GPT-5.6 Sol کو 750 آؤٹ پٹ ٹوکن فی سیکنڈ تک چلانے کے قابل بناتی ہے، جو ریئل ٹائم رفتار پر فرنٹیئر لیول انٹیلی جنس فراہم کرتی ہے۔ AI ہارڈویئر کی تازہ ترین خبروں کے لیے، AI Buzz Wire ملاحظہ کریں۔
سپیڈ انٹیلی جنس ٹریڈ آف کو ختم کرنا
AI بنانے والوں کو طویل عرصے سے ایک بنیادی تجارت کا سامنا کرنا پڑا ہے: جیسا کہ ماڈل سائز اور ذہانت میں اضافہ کرتے ہیں، وہ زیادہ کمپیوٹیشنل اور ڈیٹا کی نقل و حرکت کے اخراجات اٹھاتے ہیں، جس سے ردعمل کا وقت کم ہو جاتا ہے۔ ڈویلپرز کو اعلیٰ معیار کے نتائج کا انتظار کرنے یا کم وقت میں کمتر نتائج کو قبول کرنے کے درمیان انتخاب کرنے پر مجبور کیا گیا۔
الٹرا فاسٹ موڈ پر GPT-5.6 سول اس مخمصے کو حل کرنے کے لیے ڈیزائن کیا گیا ہے۔ Cerebras کے مطابق، سروس Anthropic کے Claude Fable 5 سے 11 گنا تیز اور فاسٹ موڈ پر Opus 4.8 سے 5 گنا زیادہ تیز چلتی ہے، مصنوعی تجزیہ کے ذریعہ رپورٹ کردہ آؤٹ پٹ کی رفتار کی بنیاد پر۔
انسانیت کا آخری امتحان: رفتار کا امتحان
سیریبراس نے الٹرا فاسٹ کو ہیومینٹی کے آخری امتحان (HLE) میں مقابلہ کرنے والے ماڈلز کے خلاف امتحان میں ڈالا، جو کہ 2,500 سوالات پر مشتمل ایک چیلنجنگ بینچ مارک ہے جو عام طور پر صرف کیمسٹری، معاشیات اور ادب جیسے شعبوں میں پی ایچ ڈی رکھنے والوں کے جوابات دیتے ہیں۔
Cerebras کی طرف سے کئے گئے جائزوں میں، الٹرا فاسٹ موڈ پر GPT-5.6 سول نے 11 گھنٹے اور 11 منٹ میں HLE کے تمام 2,500 سوالات کے جوابات دیئے۔ Claude Fable 5 کو اسی نتیجے پر پہنچنے کے لیے 78 گھنٹے اور 27 منٹ، تین دن سے زیادہ مسلسل کمپیوٹنگ کی ضرورت تھی۔ دوسرے لفظوں میں، الٹرا فاسٹ نے کام کے ایک ہی دن میں انسانی علم کی سرحد پر کارروائی کی، تقابلی درستگی تقریباً سات گنا زیادہ تیزی سے حاصل کی۔
10 جولائی کو اعلی استدلال کی ترتیبات پر کوڈیکس کے ساتھ GPT-5.6 Sol Ultrafast اور 13 سے 15 جولائی تک Claude Fable 5 اور Claude Fable 5 کا استعمال کرتے ہوئے Cerebras کے ذریعے بینچ مارکنگ کی گئی۔
حقیقی دنیا کے کاروباری اثرات
GDP-Val پر، اقتصادی طور پر قابل قدر علمی کاموں کے لیے ایک معیار، Ultrafast نے بغیر کسی معیار کے انحطاط کے 5.6x اختتام سے آخر تک رفتار فراہم کی۔ اس سے یہ ظاہر ہوتا ہے کہ آؤٹ پٹ کوالٹی کو قربان کیے بغیر کس قدر تیز اندازہ معاشی طور پر قیمتی کام کو تیز کر سکتا ہے۔
سیریبراس الٹرا فاسٹ کو ایسے منظرناموں کے لیے ایک ٹول کے طور پر تصور کرتا ہے جہاں ہر سیکنڈ اہمیت رکھتا ہے۔ ویب سروسز کو آپریٹ کرنے والی کمپنیاں اس ٹیکنالوجی کا استعمال بنیادی وجہ اور پیداواری بندش کو زیادہ تیزی سے حل کرنے کے لیے کر سکتی ہیں، گاہک کے اعتماد کو برقرار رکھنے اور ضائع ہونے والی آمدنی کو روکنے کے لیے۔ ہائی اسٹیک سائبرسیکیوریٹی حالات میں، سیکیورٹی ٹیمیں حملوں کا تیزی سے پتہ لگانے اور ان کا جواب دینے کے لیے الٹرا فاسٹ کا فائدہ اٹھا سکتی ہیں۔
رفتار کے پیچھے ٹیکنالوجی
کارکردگی کا فائدہ Cerebras کے Wafer-Scale Engine کے فن تعمیر سے حاصل ہوتا ہے، جو کہ فرنٹیئر AI کام کے بوجھ کے لیے بنایا گیا ہے۔ فاسٹ فرنٹیئر انفرنس کا بنیادی چیلنج ڈیٹا کی نقل و حرکت کا مسئلہ ہے: روایتی GPUs پر، بڑے ماڈلز کا اندازہ میموری بینڈوڈتھ کی وجہ سے رکاوٹ کا شکار ہوتا ہے، کیونکہ ماڈل کے وزن کو بار بار آن چپ میموری اور آف چپ اسٹوریج کے درمیان منتقل ہونا ضروری ہے تاکہ یکے بعد دیگرے ٹوکن بنائے جائیں۔
Cerebras ایک بنیادی طور پر مختلف نقطہ نظر لیتا ہے. ہر ویفر سائز کی چپ 44 GB SRAM کو براہ راست سلکان پر پیک کرتی ہے۔ ماڈل کا وزن چپ پر رہتا ہے، اور ٹوکنز بغیر کسی رکاوٹ کے ماڈل کی تہوں کے ذریعے پائپ لائنوں کے درمیان بہہ جاتے ہیں۔ یہ ڈیٹا کی غیر موثر نقل و حرکت کو ختم کرتا ہے جو GPU پر مبنی تخمینہ کو سست کرتا ہے اور ماڈل سائز کے ساتھ آسانی سے اسکیل کرتا ہے، مستقبل کے فرنٹیئر ماڈلز پر مسلسل رفتار سے فائدہ اٹھانے کی راہ ہموار کرتا ہے۔
دستیابی اور مارکیٹ کی پوزیشننگ
الٹرا فاسٹ موڈ پر GPT-5.6 سول فی الحال صارفین کے منتخب گروپ کے لیے محدود پیش نظارہ میں دستیاب ہے، جس کی رسائی وقت کے ساتھ ساتھ بڑھتی ہوئی صلاحیت کے ساتھ پھیلتی ہے۔ Cerebras شراکت کو AI جدت طرازی کی اگلی لہر کو تقویت دینے اور تنظیموں کو جوابدہ AI کے ساتھ کیا حاصل کر سکتی ہیں اس کی حد کو بڑھانے کے طور پر بیان کرتا ہے۔
یہ تعاون سیریبراس کے لیے ایک اہم سنگ میل کی نمائندگی کرتا ہے، جس نے طویل عرصے سے جی پی یو کے زیر اثر AI ہارڈویئر مارکیٹ کے متبادل کے طور پر ویفر اسکیل کمپیوٹنگ کی پیروی کی ہے۔ دستیاب سب سے زیادہ قابل فرنٹیئر ماڈلز میں سے ایک کو تیز کرنے کے لیے OpenAI کے ساتھ براہ راست شراکت داری کرتے ہوئے، Cerebras ایک مضبوط کیس بنا رہا ہے کہ اس کا فن تعمیر تیز رفتار انفرنس ورک بوجھ کے لیے ایک حقیقی مسابقتی فائدہ پیش کرتا ہے۔
جیسا کہ ماڈلز بڑے اور ذہین ہوتے جارہے ہیں، ان کو حقیقی وقت کی رفتار پر پیش کرنے کی صلاحیت AI انفراسٹرکچر مارکیٹ میں ایک واضح مسابقتی عنصر بن سکتی ہے۔ Cerebras-OpenAI پارٹنرشپ اس بات کا اشارہ دیتی ہے کہ اندازہ کی رفتار کی دوڑ اب اتنی ہی اہم ہے جتنی کہ ماڈل انٹیلی جنس کی دوڑ۔
AI سے آگے رہیں
مزید AI ہارڈویئر کی خبروں، ماڈل کی کارکردگی کے تجزیہ اور صنعت کی ترقی کے لیے، بک مارک AI Buzz Wire۔
مزید AI خبریں پڑھیں →