ایڈوانسڈ مائیکرو ڈیوائسز نے ٹورنٹو میں قائم ایک سٹارٹ اپ Taalas کو حاصل کرنے کے لیے ایک حتمی معاہدے پر پہنچ گیا ہے جو مصنوعی ذہانت کے ماڈلز کو براہ راست سلیکون میں ہارڈ وائر کرتا ہے، جس کا مقصد AI تخمینہ کو ڈرامائی طور پر تیز کرنا ہے۔ یہ معاہدہ، جس کا اعلان 6 اگست 2026 کو ہوا، AMD کی جانب سے Cerebras کے ساتھ ایک علیحدہ معاہدے پر دستخط کرنے کے چند ہفتوں بعد سامنے آیا ہے اور AI ہارڈویئر میں Nvidia کے غلبے کو چیلنج کرنے کے لیے ایک جارحانہ دباؤ کا اشارہ ہے۔

حصول اس بات کی عکاسی کرتا ہے کہ سیمی کنڈکٹر زمین کی تزئین کی کتنی تیزی سے تبدیلی آرہی ہے کیونکہ کمپنیاں AI ماڈلز کو چلانے کے سستے، تیز ترین طریقوں کا پیچھا کرتی ہیں۔ میدان کو نئی شکل دینے والی چپ جنگوں کی جاری AI انڈسٹری کوریج کے لیے، AI Buzz Wire ہر بڑے اقدام کی پیروی کر رہا ہے۔

Taalas اصل میں کیا کرتا ہے

Taalas نام نہاد میموری وال کے لیے ایک غیر روایتی انداز اختیار کرتا ہے - وہ رکاوٹ جہاں GPUs بے کار بیٹھے رہتے ہیں کہ میموری سے ڈیٹا آنے کا انتظار کیا جائے اس سے پہلے کہ وہ نمبروں کو کرنچنگ شروع کر سکیں۔ ایک علیحدہ میموری بینک سے ماڈل کے وزن کو لانے کے بجائے، ٹالاس جسمانی طور پر ان وزنوں کو انفرادی ٹرانزسٹروں میں مضبوط کرتا ہے۔

سٹارٹ اپ کا ملکیتی ڈیجیٹل فن تعمیر 4 بٹس ڈیٹا کو محفوظ کر سکتا ہے اور ایک ہی ٹرانجسٹر کا استعمال کرتے ہوئے ریاضی کی کارروائیوں کو انجام دے سکتا ہے۔ اس کی HC1 چپ میں مشترکہ ہارڈویئر بلاکس کی خصوصیات ہیں جو 4 بٹ ماڈل وزن کے لیے تمام 16 ممکنہ مصنوعات کو مستقل طور پر پہلے سے گنتی کرتے ہیں۔ چونکہ ہر ممکنہ ریاضیاتی نتیجہ پہلے ہی چپ پر براہ راست ہو رہا ہے، انفرادی ٹرانجسٹر کیلکولیٹر کے بجائے ایک فزیکل راؤٹر کے طور پر کام کرتا ہے۔

AI ماڈل کے ہر مخصوص وزن کی نمائندگی ایک واحد ماسک ROM ٹرانزسٹر کے ذریعے کی جاتی ہے۔ مینوفیکچرنگ کے دوران، ایک مائکروسکوپک دھات کی تہہ کو جسمانی طور پر اس ٹرانجسٹر کو 16 پری کمپیوٹیڈ پروڈکٹ لائنوں میں سے ایک سے جوڑنے کے لیے بنایا جاتا ہے۔ جب ڈیٹا چپ کے ذریعے بہتا ہے، تو ٹرانجسٹر صرف صحیح پہلے سے حساب شدہ چینل کا انتخاب کرتا ہے اور نتیجہ ایک ایڈر کو منتقل کرتا ہے۔ جوہر میں، سرکٹ میموری اور پروسیسر دونوں کو ملا ہوا ہے۔

کمپنی کے مطابق نتیجہ حیران کن ہے: HC1 چپ تقریباً 16,000 سے 17,000 ٹوکن فی سیکنڈ فی صارف پیدا کر سکتی ہے۔ یہ نقطہ نظر Groq LPU کی یاد دلاتا ہے، جو اسی طرح AI ماڈل کے وزن کو براہ راست تیز آن چپ SRAM میں بیک کرتا ہے تاکہ میموری کی رکاوٹ کو نظرانداز کیا جا سکے۔

کیچ: ایک ماڈل کے لیے بنائی گئی ایک چپ

لین دین اہم ہے۔ چونکہ ماڈل کا وزن جسمانی طور پر سلیکون میں جڑا ہوا ہے، اس لیے ہر ٹالاس چپ صرف اس مخصوص AI ماڈل کے لیے کام کرتی ہے جس کے لیے اسے ڈیزائن کیا گیا تھا۔ یہ ایک قابل پروگرام، عام مقصد کا تیز رفتار نہیں ہے۔ یہ اسے GPU سے بنیادی طور پر مختلف تجویز بناتا ہے، جو اس کی میموری میں بھری ہوئی کسی بھی ماڈل کو چلا سکتا ہے۔

صنعت کے تجزیہ کاروں نے قیاس کیا ہے کہ Taalas کی ٹیکنالوجی AMD کے وسیع تر ریک اسکیل سسٹمز کے اندر ایک سرشار ڈیکوڈ ایکسلریٹر کے طور پر کام کر سکتی ہے - دوسرے، تاخیر سے متعلق حساس مرحلے کو ہینڈل کر رہی ہے - جبکہ زیادہ لچکدار ہارڈویئر جیسا کہ Cerebras سے چلنے والا Helios سسٹم پری فل فیز کو ہینڈل کرتا ہے۔ AMD نے ابھی تک قطعی طور پر تفصیل نہیں دی ہے کہ Taalas کے چپس اس کے پروڈکٹ روڈ میپ میں کہاں جائیں گے۔

طالس کس نے بنایا؟

Taalas کی بنیاد 2023 میں AMD کے سابق ملازمین اور لیڈروں کی تینوں نے Tenstorrent میں رکھی تھی، ٹورنٹو میں قائم، اب سانتا کلارا میں مقیم AI چپ میکر ہے۔ بانی ٹیم میں CEO Ljubisa Bajic، ایک شریک بانی اور سابق چیف ایگزیکٹو، چیف ٹیکنالوجی آفیسر، اور Tenstorrent کے صدر شامل ہیں۔ COO Lejla Bajic؛ اور CTO Drago Ignjatovic۔

کمپنی 2024 میں اسٹیلتھ سے ابھری، جس نے Quiet Capital اور تجربہ کار سیمی کنڈکٹر سرمایہ کار پیئر لیمنڈ، دوسروں کے درمیان $50 ملین کی فنڈنگ ​​کا انکشاف کیا۔ اس سے قبل 2026 میں اس نے ایک گروپ سے $169 ملین اضافی دینے کا اعلان کیا تھا جس میں فیڈیلیٹی بھی شامل تھی۔ Taalas نے دعویٰ کیا ہے کہ وہ صنعتی معیار کے مقابلے میں دو ماہ سے کم عرصے میں ایک نئی کسٹم چپ لانچ کر سکتا ہے جو اکثر ایک یا دو سال تک پھیلا ہوا ہوتا ہے، اور شرط لگاتا ہے کہ یہ سافٹ ویئر پر مبنی ہم منصبوں سے ہزار گنا زیادہ موثر ہارڈ ویئر تیار کر سکتا ہے۔

AMD کے حصول کی مالی شرائط ظاہر نہیں کی گئیں۔ لین دین بند ہونے کی شرائط اور ریگولیٹری منظوری سے مشروط ہے۔

AMD اب کیوں خرید رہا ہے۔

AMD نے Taalas کو خصوصی AI inference silicon میں ایک علمبردار کے طور پر بیان کیا جس کی ٹیکنالوجی AI inference dataflows کو بہتر بناتی ہے اور عام مقصد کے فن تعمیر سے وابستہ کمپیوٹ اور میموری کی رکاوٹوں کو نمایاں طور پر کم کرتی ہے۔

اس کے AI گروپ کے اے ایم ڈی کے سینئر نائب صدر وامسی بوپپانا نے ایک نیوز ریلیز میں کہا، "Talas کی ٹیکنالوجی اور عالمی معیار کی انجینئرنگ ٹیم ہمارے AI پورٹ فولیو کو امتیازی کارکردگی اور کارکردگی فراہم کر کے مضبوط کرتی ہے۔"

معاہدہ ایک وسیع پیٹرن کو بڑھاتا ہے۔ AMD کا Cerebras کے ساتھ پہلے کا معاہدہ بعد کے Wafer-Scale Engine کو آنے والے Helios ریک اسکیل سسٹم میں ضم کرتا ہے، جو سلیکون کی ایک واحد، باہم مربوط شیٹ پر بہت زیادہ میموری اور کمپیوٹ رکھتا ہے۔ Taalas کو شامل کرنے سے AMD کو اس کے اپنے Instinct GPUs اور Cerebras پارٹنرشپ کے ساتھ، اس کے انفرنس ہتھیاروں میں ایک تیسرا الگ ہتھیار ملتا ہے۔

AMD کے لیے، اپیل واضح ہے۔ Nvidia نے اپنے GPU ایکو سسٹم کے ساتھ AI ٹریننگ اور اندازہ پر غلبہ حاصل کرنا جاری رکھا ہوا ہے، اور چیلنجرز نے عام مقصد کے کمپیوٹ پر مقابلہ کرنے کے لیے جدوجہد کی ہے۔ بنیادی طور پر مختلف فن تعمیرات والی کمپنیوں کو حاصل کرکے - ویفر اسکیل انجن، ہارڈ وائرڈ ماڈل سلیکون - AMD شرط لگا رہا ہے کہ خصوصی ہارڈویئر منافع بخش جگہوں کو تیار کرے گا جو Nvidia کے ایک سائز کے فٹ ہونے والے تمام GPUs مؤثر طریقے سے کام نہیں کرسکتے ہیں۔

شفٹنگ انفرنس مارکیٹ

حصول ایک وسیع صنعت کی تبدیلی سے بھی بات کرتا ہے۔ جیسے جیسے AI ماڈلز بڑے ہو رہے ہیں اور تخمینے کی قیمت بڑھ رہی ہے، انہیں عام مقصد کے GPUs پر چلانے کی معاشیات دباؤ میں آ رہی ہے۔ خصوصی انفرنس چپس اعلی حجم کی تعیناتیوں کے لیے لاگت میں ڈرامائی کمی کا وعدہ کرتی ہیں، جہاں ایک ہی ماڈل کو لاکھوں بار چلایا جاتا ہے۔

اگر AMD Taalas کے ہارڈ وائرڈ اپروچ کو کامیابی کے ساتھ تجارتی بنا سکتا ہے، تو یہ کلاؤڈ فراہم کرنے والوں اور کاروباری اداروں کو روایتی GPUs کی لاگت اور تاخیر کے ایک حصے پر مقبول ماڈلز چلانے کا ایک طریقہ پیش کر سکتا ہے - بشرطیکہ وہ ایک ہی ماڈل کے ارد گرد بنائے گئے سلیکون کے لیے عہد کرنے کے لیے تیار ہوں۔

چپ جنگوں سے آگے رہیں

AI ہارڈویئر کی بالادستی کی جنگ تیز ہوتی جا رہی ہے، ہر حصول طاقت کے توازن کو نئی شکل دے رہا ہے۔ انٹیلی جنس کی اگلی نسل کو چلانے والے سلکان میں گہرے غوطہ لگانے کے لیے ہماری تازہ ترین AI پیشرفت پر عمل کریں۔

مزید AI خبریں پڑھیں →