Advanced Micro Devices با هدف تسریع چشمگیر استنتاج هوش مصنوعی، به توافق قطعی برای خرید Taalas، یک استارت آپ مستقر در تورنتو که مدل های هوش مصنوعی را مستقیماً به سیلیکون متصل می کند، دست یافته است. این قرارداد که در 6 آگوست 2026 اعلام شد، تنها چند هفته پس از امضای توافقنامه جداگانه AMD با Cerebras و نشانه تلاش تهاجمی برای به چالش کشیدن تسلط انویدیا در سخت افزار هوش مصنوعی انجام شد.
این خرید منعکس کننده سرعت تغییر چشم انداز نیمه هادی است زیرا شرکت ها به دنبال راه های ارزان تر و سریع تر برای اجرای مدل های هوش مصنوعی هستند. برای ادامه [پوشش صنعت AI] (https://aibuzzwire.news) از جنگ تراشهها که این میدان را تغییر میدهد، AI Buzz Wire هر حرکت مهمی را دنبال میکند.
آنچه Taalas در واقع انجام می دهد
Taalas رویکردی غیر متعارف را برای دیوار حافظه اتخاذ میکند - گلوگاهی که GPUها در آن منتظر میمانند تا دادهها از حافظه برسند قبل از اینکه بتوانند اعداد را خرد کنند. Taalas به جای واکشی وزن های یک مدل از یک بانک حافظه جداگانه، به صورت فیزیکی آن وزن ها را به ترانزیستورهای جداگانه متصل می کند.
معماری دیجیتال اختصاصی این استارت آپ می تواند 4 بیت داده را ذخیره کند و عملیات ریاضی را با استفاده از یک ترانزیستور انجام دهد. تراشه HC1 آن دارای بلوکهای سختافزاری مشترک است که بهطور دائمی همه 16 محصول ممکن را برای وزن مدل 4 بیتی کوانتیزه شده از قبل محاسبه میکند. از آنجایی که هر نتیجه ممکن ریاضی در حال حاضر به صورت زنده در سراسر تراشه اتفاق می افتد، ترانزیستور فردی به جای یک ماشین حساب به عنوان یک روتر فیزیکی عمل می کند.
هر وزن مخصوص مدل هوش مصنوعی با یک ترانزیستور Mask ROM نشان داده می شود. در طول تولید، یک لایه فلزی میکروسکوپی حک می شود تا ترانزیستور را به صورت فیزیکی به یکی از 16 خط تولید از پیش محاسبه شده متصل کند. هنگامی که داده ها از طریق تراشه جریان می یابد، ترانزیستور به سادگی کانال صحیح از پیش محاسبه شده را انتخاب می کند و نتیجه را به جمع کننده ارسال می کند. در اصل، مدار هم حافظه و هم پردازنده است.
به گفته این شرکت، نتیجه خیره کننده است: تراشه HC1 می تواند تقریباً 16000 تا 17000 توکن در ثانیه برای هر کاربر تولید کند. این رویکرد یادآور Groq LPU است که به طور مشابه وزنهای مدل هوش مصنوعی را مستقیماً در SRAM سریع روی تراشه میسازد تا از تنگنای حافظه عبور کند.
The Catch: تراشه ای که برای یک مدل ساخته شده است
مبادله قابل توجه است. از آنجایی که وزن های مدل به صورت فیزیکی در سیلیکون حک شده است، هر تراشه Taalas فقط برای مدل خاصی که برای آن طراحی شده است کار می کند. این یک شتاب دهنده قابل برنامه ریزی و همه منظوره نیست. این باعث می شود که این پیشنهاد اساساً متفاوت از یک GPU باشد که می تواند هر مدلی را که در حافظه خود بارگذاری شده است اجرا کند.
تحلیلگران صنعت حدس میزنند که فناوری Taalas میتواند بهعنوان یک شتابدهنده رمزگشایی اختصاصی در سیستمهای بزرگتر AMD در مقیاس رک عمل کند - مرحله دوم استنتاج حساس به تأخیر را مدیریت میکند - در حالی که سختافزار انعطافپذیرتر مانند سیستم Helios با انرژی مغزی، فاز پیشپر را کنترل میکند. AMD هنوز جزئیات دقیقی را ارائه نکرده است که تراشه های Taalas در نقشه راه محصول خود کجا قرار می گیرند.
چه کسی تاالاس را ساخت
Taalas در سال 2023 توسط سه نفر از کارمندان و رهبران سابق AMD در Tenstorrent، سازنده تراشههای هوش مصنوعی مستقر در سانتا کلارا در تورنتو تأسیس شد. تیم موسس شامل مدیر عامل شرکت Ljubisa Bajic، یکی از بنیانگذاران و مدیر اجرایی سابق، مدیر ارشد فناوری، و رئیس Tenstorrent است. مدیر اجرایی لژلا باجیچ؛ و مدیر ارشد فناوری دراگو ایگناتوویچ.
این شرکت در سال 2024 از مخفی کاری بیرون آمد و 50 میلیون دلار سرمایه از سوی Quiet Capital و سرمایه گذار کهنه کار نیمه هادی پیر لاموند و دیگران فاش کرد. پیش از این در سال 2026، 169 میلیون دلار اضافی از گروهی شامل Fidelity را اعلام کرد. Taalas ادعا کرده است که میتواند یک تراشه سفارشی جدید را در کمتر از دو ماه راهاندازی کند، در مقایسه با استانداردهای صنعتی که اغلب تا یک یا دو سال طول میکشد، و شرط کرده است که میتواند سختافزاری هزار برابر کارآمدتر از همتایان مبتنی بر نرمافزار تولید کند.
شرایط مالی خرید AMD فاش نشده است. معامله همچنان مشمول شرایط بسته شدن و تأییدیه نظارتی است.
چرا AMD اکنون خرید می کند
AMD Taalas را پیشگام در سیلیکون استنتاج تخصصی هوش مصنوعی توصیف کرد که فناوری آن جریان داده استنتاج هوش مصنوعی را بهینه می کند و به طور قابل توجهی گلوگاه های محاسباتی و حافظه مرتبط با معماری های همه منظوره را کاهش می دهد.
وامسی بوپانا، معاون ارشد گروه هوش مصنوعی AMD در بیانیهای گفت: «تیم فنی و مهندسی کلاس جهانی Taalas با ارائه عملکرد و کارایی استنتاج متفاوت، مجموعه هوش مصنوعی ما را تقویت میکند.
معامله الگوی گسترده تری را گسترش می دهد. توافق قبلی AMD با Cerebras، موتور مقیاس ویفر دومی را در سیستم مقیاس رک Helios ادغام میکند، که حجم عظیمی از حافظه و محاسبات را روی یک صفحه سیلیکونی به هم پیوسته قرار میدهد. افزودن Taalas به AMD سومین سلاح متمایز را در زرادخانه استنتاج خود در کنار پردازندههای گرافیکی Instinct خود و مشارکت Cerebras میدهد.
برای AMD، جذابیت واضح است. انویدیا همچنان بر آموزش و استنتاج هوش مصنوعی با اکوسیستم GPU خود تسلط دارد و رقبا برای رقابت در محاسبات همه منظوره تلاش کرده اند. AMD با خرید شرکتهایی با معماریهای اساسی متفاوت - موتورهای در مقیاس ویفر، سیلیکون مدلهای سیمکشی شده - شرط میبندد که سختافزار تخصصی جایگاههای سودآوری را ایجاد میکند که پردازندههای گرافیکی یکاندازه انویدیا نمیتوانند به همان اندازه کارآمد عمل کنند.
بازار استنتاج در حال تغییر
این خرید همچنین از تغییر صنعت گسترده تر صحبت می کند. همانطور که مدلهای هوش مصنوعی بزرگتر میشوند و هزینههای استنتاج افزایش مییابد، اقتصاد اجرای آنها روی GPUهای همه منظوره تحت فشار قرار میگیرد. تراشههای استنتاج تخصصی کاهش هزینههای چشمگیر را برای استقرار با حجم بالا، که در آن مدلهای مشابه میلیونها بار اجرا میشود، نوید میدهند.
اگر AMD بتواند رویکرد سخت سیمی Taalas را با موفقیت تجاریسازی کند، میتواند به ارائهدهندگان و شرکتهای ابری راهی برای اجرای مدلهای محبوب با کسری از هزینه و تأخیر پردازندههای گرافیکی سنتی ارائه دهد - مشروط بر اینکه آنها مایل به متعهد شدن به سیلیکون ساخته شده بر اساس یک مدل واحد باشند.
جلوتر از جنگ تراشه ها باشید
نبرد برای برتری سختافزاری هوش مصنوعی در حال تشدید است و هر خریدی تعادل قدرت را تغییر میدهد. آخرین پیشرفتهای هوش مصنوعی ما را برای غواصی عمیق در سیلیکون که نسل بعدی هوش را هدایت میکند دنبال کنید.
بیشتر بخوانید اخبار هوش مصنوعی →