AMD اور Cerebras Systems نے AMD کے ریک اسکیل Helios پلیٹ فارم کو Cerebras Wafer-scale Engine (WSE) کے ساتھ یکجا کرتے ہوئے ایک نئی قسم کے AI inference انفراسٹرکچر کی تعمیر کے لیے ایک تکنیکی شراکت کی نقاب کشائی کی ہے۔ 23 جولائی 2026 کو AMD کے ایڈوانسنگ AI 2026 ایونٹ میں اعلان کیا گیا، اس تعاون کا براہ راست مقصد تاخیر اور تھرو پٹ رکاوٹوں پر ہے جس نے تخلیقی AI دور میں سب سے مہنگے مسائل میں سے ایک کا اندازہ لگایا ہے۔ صنعت کے اس تیزی سے آگے بڑھتے ہوئے کونے کے بارے میں تازہ ترین معلومات کے لیے، ہماری بریکنگ AI نیوز کوریج کی پیروی کریں۔

بنیادی خیال ایک چپ کو سب کچھ کرنے پر مجبور کرنا بند کرنا ہے۔ روایتی انفرنس اسٹیک میں، ایک واحد GPU فیملی پرامپٹ کو ہضم کرنے کے بھاری بھرکم کام اور ہر نیا ٹوکن تیار کرنے کے نازک، ترتیب وار کام دونوں کو ہینڈل کرتی ہے۔ یہ ایک سمجھوتہ ہے، کیونکہ دونوں ملازمتوں کے بہت مختلف مطالبات ہیں۔ AMD اور Cerebras کا استدلال ہے کہ کام کو تقسیم کرنا، ایک تکنیک جس کو disaggregated inference کے نام سے جانا جاتا ہے، ہر انجن کو وہ کرنے دیتا ہے جس میں وہ بہترین ہے۔

دو انجن محنت کو کیسے تقسیم کرتے ہیں۔

AMD کے باضابطہ اعلان کے مطابق، AMD Helios اعلی کارکردگی، توسیع پذیر تھرو پٹ انجن کے طور پر کام کرے گا، AMD Instinct GPUs پر تیزی سے ان پٹ کے بڑے بیچوں کو پروسیس کرنے کے لیے۔ Cerebras Wafer-Scale Engine، اس دوران، انتہائی تیز، انتہائی کم لیٹنسی ڈی کوڈ اور ٹوکن جنریشن کو سنبھالے گا۔ سیریبراس کے چپس انفرادی ڈائس میں کاٹنے کے بجائے پورے ویفرز پر بنائے جاتے ہیں، جس سے انہیں بہت زیادہ آن چپ میموری بینڈوڈتھ ملتی ہے جو خاص طور پر بغیر رکے ٹوکنز کو اسٹریم کرنے کے لیے موزوں ہے۔

کمپنیوں کا کہنا ہے کہ دو کمپیوٹ انجنوں کو ملا کر، مشترکہ حل سے 5x زیادہ ٹوکن فی سیکنڈ فی واٹ تک فراہم کرنے کی توقع ہے، یہ ایک میٹرک ہے جو انفرنس اکنامکس کے لیے ایک مرکزی سکور کارڈ بن گیا ہے کیونکہ فراہم کنندگان رفتار اور توانائی کے اخراجات دونوں پر مقابلہ کرتے ہیں۔ اعداد و شمار کا حوالہ AMD کی پریس ریلیز میں دیا گیا تھا اور ٹام کے ہارڈ ویئر، Investing.com، اور Yahoo Tech سمیت تمام آؤٹ لیٹس پر رپورٹ کیا گیا تھا۔

Nvidia کے غلبے پر ایک شاٹ

شراکت داری بھی ایک اسٹریٹجک سگنل ہے۔ Nvidia کا CUDA ماحولیاتی نظام اور GPU لائن اپ فی الحال AI کی تربیت اور تخمینہ پر حاوی ہے، اور چیلنجرز نے تیزی سے یہ نتیجہ اخذ کیا ہے کہ کسی ایک فن تعمیر پر موجودہ سر کو شکست دینا مشکل ہے۔ بزنس انسائیڈر نے اس معاہدے کو تیار کیا جب AMD نے Nvidia پر قیاس آرائی کی شرط لگائی، AI کمپیوٹنگ کا مرحلہ تیزی سے بڑھنے کی توقع ہے کیونکہ ماڈلز ترقی سے پیداوار کی طرف بڑھیں گے۔

AMD کے لیے، Cerebras کے ساتھ جوڑا بنانے سے اس کی Instinct اور Helios روڈ میپ کی اپیل کو تربیت سے آگے بڑھایا جاتا ہے۔ Cerebras کے لیے، جو AMD (NASDAQ: AMD) کے ساتھ ٹکر CBRS کے تحت Nasdaq پر تجارت کرتا ہے، ایک بڑے ایکسلریٹر وینڈر کے ساتھ انضمام اس کی ویفر اسکیل ٹیکنالوجی کو بڑے انٹرپرائز اور کلاؤڈ کی تعیناتیوں میں ایک واضح راستہ فراہم کرتا ہے۔ Cerebras AMD Helios کو اپنے ڈیٹا سینٹرز میں تعینات کرنے کا ارادہ رکھتا ہے، اور کمپنیاں توقع کرتی ہیں کہ مشترکہ حل سب سے پہلے Cerebras Cloud کے ذریعے 2026 کے دوسرے نصف حصے میں دستیاب ہوگا۔

اب اختلاف کیوں اہم ہے؟

تخمینہ لاگت AI صنعت کے لیے ایک متعین دباؤ کا نقطہ بن گیا ہے۔ جیسے جیسے ماڈل بڑے ہوتے جاتے ہیں اور ایپلیکیشنز ریئل ٹائم جوابات کا مطالبہ کرتی ہیں، ہر ٹوکن پیدا کرنے کا خرچ، اور صارفین کو اس کے انتظار میں تاخیر کا تجربہ ہوتا ہے، اس بات کا تعین کر سکتے ہیں کہ آیا کوئی پروڈکٹ قابل عمل ہے۔ الگ الگ انفرنس پری فل اور ڈی کوڈ کو الگ الگ ورک بوجھ کے طور پر مانتا ہے جو ہر ایک کے ساتھ بہترین مماثل ہارڈ ویئر کی طرف لے جایا جا سکتا ہے، یہ ایک ڈیزائن فلسفہ ہے جسے سیریبراس جیسی کمپنیاں ایک سال سے زیادہ عرصے سے جیت رہی ہیں۔

AMD-Cerebras کے اعلان سے پتہ چلتا ہے کہ نقطہ نظر ایک باغی خیال سے صنعت کی توثیق شدہ فن تعمیر کی طرف بڑھ رہا ہے۔ لیٹنسی اسپیشلسٹ کے ساتھ تھرو پٹ اسپیشلسٹ کا جوڑا بنا کر، دونوں کمپنیاں شرط لگا رہی ہیں کہ انفرنس کا مستقبل ان سب پر حکمرانی کرنے کے لیے ایک چپ نہیں ہے، بلکہ خصوصی انجنوں کا ایک مربوط نظام ہے۔

کیا دیکھنا ہے۔

کئی سوال باقی ہیں۔ 5x ٹوکن فی سیکنڈ فی واٹ کا اعداد و شمار تھرڈ پارٹی بینچ مارک کے بجائے ایک توقع ہے، اور حقیقی دنیا کی کارکردگی کا انحصار مخصوص ماڈلز اور کسٹمرز کے کام کے بوجھ پر ہوگا۔ Cerebras Cloud لانچ کے بعد قیمتوں اور دستیابی کی تفصیلات کا انکشاف نہیں کیا گیا ہے، اور یہ واضح نہیں ہے کہ یہ حل دوسرے کلاؤڈ فراہم کنندگان تک کب پہنچ سکتا ہے۔

پھر بھی، یہ معاہدہ AI ہارڈویئر میں ایک وسیع تر تبدیلی کی نشاندہی کرتا ہے: یہ مفروضہ کہ ایک GPU فن تعمیر AI پائپ لائن کے ہر مرحلے پر کام کرے گا۔ اگر AMD اور Cerebras اپنی کارکردگی کے دعووں کو پورا کر سکتے ہیں، تو الگ الگ اندازہ اس بات کا ایک معیاری حصہ بن سکتا ہے کہ سب سے بڑے AI سسٹم کیسے بنائے جاتے ہیں۔

AI سے آگے رہیں

AI ہارڈ ویئر کی زمین کی تزئین کی خصوصی کیمپوں میں تقسیم ہو رہی ہے، اور لاگت، رفتار، اور مسابقت کے مضمرات بہت زیادہ ہیں۔ مزید AI خبریں پڑھیں AI Buzz Wire پر ہر بڑی ڈیل، ریلیز، اور بینچ مارک کو برقرار رکھنے کے لیے۔