Cerebras اور OpenAI نے دنیا کو الٹرا فاسٹ موڈ پر ایک ابتدائی نظر دی ہے، ایک نیا سروس ٹیر جو OpenAI API میں پہلے لانچ ہوتا ہے اور Cerebras ہارڈویئر سے چلتا ہے۔ 13 اگست 2026 کو شائع ہونے والے Cerebras کے اعلان کے مطابق، الٹرا فاسٹ پر چلنے والا GPT-5.6 Sol فی سیکنڈ تک 750 آؤٹ پٹ ٹوکن فراہم کرتا ہے — معیار میں کوئی سمجھوتہ نہیں۔

یہ درجہ ابتدائی طور پر صارفین کے منتخب گروپ کے لیے دستیاب ہے، جس کی رسائی وقت کے ساتھ ساتھ بڑھ رہی ہے۔ Cerebras' Joyce Er کی طرف سے لکھا گیا اعلان، پیشکش کو تجارتی بند کے لیے ایک قرارداد کے طور پر پیش کرتا ہے جس نے برسوں سے AI پروڈکٹ کی ترقی کی تعریف کی ہے: تعمیر کنندگان کو رفتار اور ذہانت کے درمیان انتخاب کرنا پڑتا ہے، کیونکہ بڑے اور ہوشیار ماڈلز زیادہ کمپیوٹیشنل اور ڈیٹا کی نقل و حرکت کے اخراجات اٹھاتے ہیں جو ردعمل کے اوقات کو کم کرتے ہیں۔ فرنٹیئر ماڈلز کو تیز کرنے کی دوڑ کی پیروی کرنے والے قارئین AI Buzz Wire پر تازہ ترین پیشرفت کو ٹریک کر سکتے ہیں۔

الٹرا فاسٹ کتنا تیز ہے، بالکل؟

خام تھرو پٹ نمبر اپنے طور پر حیران کن ہے، لیکن Cerebras نے تقابلی سیاق و سباق بھی فراہم کیا۔ مصنوعی تجزیہ کے ذریعہ رپورٹ کردہ آؤٹ پٹ کی رفتار کے مطابق، ایک آزاد بینچ مارکنگ سروس، الٹرا فاسٹ موڈ پر GPT-5.6 Sol چلتا ہے:

  • Fable 5 سے 11x تیز
  • فاسٹ موڈ پر Opus 4.8 سے 5x تیز

دعوے کو جانچنے کے لیے، Cerebras نے Humanity's Last Exam (HLE) پر مقبول حریفوں کے خلاف ماڈل کا مقابلہ کیا، ایک چیلنجنگ بینچ مارک جس میں 2,500 سوالات شامل ہیں جن کا جواب عام طور پر صرف کیمسٹری، معاشیات اور ادب جیسے شعبوں میں پی ایچ ڈی رکھنے والے افراد ہی دیتے ہیں۔

نتیجہ: الٹرا فاسٹ پر GPT-5.6 سول نے 11 گھنٹے اور 11 منٹ میں تمام 2,500 HLE سوالات کے جوابات دیئے۔ Claude Fable 5 کو اسی نتیجے پر پہنچنے کے لیے 78 گھنٹے اور 27 منٹ — تین دن سے زیادہ مسلسل حساب کی ضرورت تھی۔ دوسرے لفظوں میں، الٹرا فاسٹ نے کام کے ایک ہی دن میں انسانی علم کی سرحدوں پر کام کیا، تقابلی درستگی تقریباً 7x تیزی سے حاصل کی۔

Cerebras نے اپنے بینچ مارکنگ کے طریقہ کار کو نوٹ کیا: GPT-5.6 Sol Ultrafast کو 10 جولائی کو اعلیٰ استدلال پر Codex کے ساتھ ٹیسٹ کیا گیا، جبکہ Claude Fable 5 کا تجربہ 13-15 جولائی کو اعلیٰ استدلال پر Claude Code کے ساتھ کیا گیا۔

حقیقی دنیا کے کام کا بوجھ، نہ صرف بینچ مارکس

رفتار کے بینچ مارکس گمراہ کن ہو سکتے ہیں اگر معیار راستے میں گر جاتا ہے، یہی وجہ ہے کہ Cerebras نے GDP-Val کے نتائج کو بھی نمایاں کیا، جو کہ معاشی طور پر قابل قدر علمی کام کے کاموں کا ایک معیار ہے۔ GDP-Val پر، الٹرا فاسٹ نے معیار میں کمی کے بغیر 5.6x اینڈ ٹو اینڈ اسپیڈ اپ فراہم کیا، ٹیسٹس کے مطابق Cerebras نے 31 جولائی 2026 کو GPT-5.6 Sol اور GPT-5.6 Sol Ultrafast کو کوڈیکس کے اندر درمیانے درجے کے استدلال پر استعمال کیا۔

کمپنی کا کہنا ہے کہ GPT-5.6 Sol قانونی بریفس، مالیاتی ماڈلز، اور انجینئرنگ رپورٹس کے لیے OpenAI کا اب تک کا بہترین ماڈل ہے - ایسے ڈومین جہاں آؤٹ پٹ کوالٹی اور ٹرناراؤنڈ ٹائم دونوں براہ راست مالیاتی نتائج کا باعث بنتے ہیں۔

رفتار ایجنٹ کی مساوات کو کیوں بدلتی ہے۔

زیادہ نتیجہ خیز تبدیلی AI ایجنٹوں کے کام کرنے کے طریقے میں ہوسکتی ہے۔ افراد اور تنظیموں کے لیے جو کچھ ممکن ہے اس کو تیز تر اندازہ تبدیل کر دیتا ہے، کیونکہ ایجنٹوں کو مسائل کے نازک راستے پر رکھا جا سکتا ہے جہاں ہر سیکنڈ کا شمار ہوتا ہے۔

"GPT-5.6 Sol Ultrafast کے ساتھ، Cerebras AI کو قابل بناتا ہے جو آپ کے سوچنے، کوڈ کرنے اور تعاون کرنے کے طریقے کو برقرار رکھتا ہے،" OpenAI کے پروڈکٹ روہن ورما نے اعلان کے حوالے سے ایک بیان میں کہا۔ "ہم یہ دیکھ کر پرجوش ہیں کہ کس طرح کام کے بہاؤ اور ایپلیکیشنز کو الٹرا فاسٹ انفرنس کے ذریعے تبدیل کیا جاتا ہے۔"

سیریبراس نے کئی اعلی اسٹیک منظرناموں کا خاکہ پیش کیا جہاں اسپیڈ اپ اہمیت رکھتا ہے:

واقعہ کا جواب

ویب سروسز آپریٹ کرنے والی کمپنیاں الٹرا فاسٹ کا استعمال پیداواری بندشوں کو جڑ سے اُٹھانے، گاہک کے اعتماد کو برقرار رکھنے، ضائع ہونے والی آمدنی کو روکنے، اور اپنے SLAs کے خلاف ڈاؤن ٹائم منٹ بچانے کے لیے کر سکتی ہیں۔

سائبر سیکیورٹی

مخالفانہ، ہائی اسٹیک سائبر حملوں میں، سیکورٹی ٹیموں کو تباہ کن نقصانات پر قابو پانے کے لیے برے اداکاروں کا فوری طور پر پتہ لگانا اور ان کا جواب دینا چاہیے۔

ایجنٹ کی پیداوری

الٹرا فاسٹ ریئل ٹائم بصیرت اور اپ ڈیٹس فراہم کر کے ایجنٹوں کے ساتھ کام کرنے کے نئے طریقوں کو قابل بناتا ہے، متوازی سیشنوں میں سیاق و سباق کو تبدیل کرنے کی ضرورت کو کم کرتا ہے۔

اوپن اے آئی کے ایک محقق جیفری وانگ نے اعلان میں کہا، "جب کہ پہلے مجھے کسی کام کو ختم کرنے کے لیے چند منٹ انتظار کرنا پڑتا تھا، اب یہ میرے لیے سیاق و سباق کو تبدیل کرنے کا موقع ملنے سے پہلے ہی ختم ہو جاتا ہے۔

شراکت داری کے پیچھے حکمت عملی

Cerebras کے لیے، یہ معاہدہ AI تخمینہ کے لیے ویفر اسکیل ایکسلریشن کو تجارتی بنانے کی کوشش میں ایک اور سنگ میل کی نمائندگی کرتا ہے۔ OpenAI کے لیے، الٹرا فاسٹ موڈ ایک ایسے وقت میں اپنے API میں ایک پریمیم اسپیڈ ٹائر کا اضافہ کرتا ہے جب انفرنس لیٹینسی ایک مسابقتی تفریق بن گئی ہے - خاص طور پر ایجنٹ ایپلی کیشنز کے لیے جو کئی ماڈل کالز کو ایک ساتھ جوڑتی ہے، جہاں فی کال تاخیر انتظار کے منٹوں میں شامل ہوتی ہے۔

کمپنیاں آنے والی معلومات کا فوری جواب دینے کے لیے فرنٹیئر AI کا استعمال کرنے والی تنظیموں کے لیے ایک مستقل کنارے کے طور پر درجے کو تیار کرتی ہیں، وقت کے لیے حساس کام کے لیے الٹرا فاسٹ پروسیسنگ کو اجناس کے کاموں کے لیے معیاری پروسیسنگ کے ساتھ جوڑتی ہیں جو پس منظر میں متوازی ہو سکتے ہیں۔

رسائی بتدریج شروع ہو رہی ہے۔ دلچسپی رکھنے والے ڈویلپرز دستیابی کے لیے OpenAI API دستاویزات کی نگرانی کر سکتے ہیں، جیسا کہ Cerebras کا کہنا ہے کہ صارفین کے ابتدائی منتخب گروپ سے وقت کے ساتھ ساتھ رسائی بڑھے گی۔

AI سے آگے رہیں

ہارڈ ویئر اور انفراسٹرکچر ریس کی مزید کوریج کے لیے مصنوعی ذہانت کو نئی شکل دینے کے لیے، AI Buzz Wire کو بک مارک کریں اور ہماری AI ہارڈویئر نیوز فیڈ کو فالو کریں۔

مزید AI خبریں پڑھیں →