Advanced Micro Devices با هدف تسریع چشمگیر استنتاج هوش مصنوعی، به توافق قطعی برای خرید Taalas، یک استارت آپ مستقر در تورنتو که مدل های هوش مصنوعی را مستقیماً به سیلیکون متصل می کند، دست یافته است. این قرارداد که در 6 آگوست 2026 اعلام شد، تنها چند هفته پس از امضای توافقنامه جداگانه AMD با Cerebras و نشانه تلاش تهاجمی برای به چالش کشیدن تسلط انویدیا در سخت افزار هوش مصنوعی انجام شد.

این خرید منعکس کننده سرعت تغییر چشم انداز نیمه هادی است زیرا شرکت ها به دنبال راه های ارزان تر و سریع تر برای اجرای مدل های هوش مصنوعی هستند. برای ادامه [پوشش صنعت AI] (https://aibuzzwire.news) از جنگ تراشه‌ها که این میدان را تغییر می‌دهد، AI Buzz Wire هر حرکت مهمی را دنبال می‌کند.

آنچه Taalas در واقع انجام می دهد

Taalas رویکردی غیر متعارف را برای دیوار حافظه اتخاذ می‌کند - گلوگاهی که GPU‌ها در آن منتظر می‌مانند تا داده‌ها از حافظه برسند قبل از اینکه بتوانند اعداد را خرد کنند. Taalas به جای واکشی وزن های یک مدل از یک بانک حافظه جداگانه، به صورت فیزیکی آن وزن ها را به ترانزیستورهای جداگانه متصل می کند.

معماری دیجیتال اختصاصی این استارت آپ می تواند 4 بیت داده را ذخیره کند و عملیات ریاضی را با استفاده از یک ترانزیستور انجام دهد. تراشه HC1 آن دارای بلوک‌های سخت‌افزاری مشترک است که به‌طور دائمی همه 16 محصول ممکن را برای وزن مدل 4 بیتی کوانتیزه شده از قبل محاسبه می‌کند. از آنجایی که هر نتیجه ممکن ریاضی در حال حاضر به صورت زنده در سراسر تراشه اتفاق می افتد، ترانزیستور فردی به جای یک ماشین حساب به عنوان یک روتر فیزیکی عمل می کند.

هر وزن مخصوص مدل هوش مصنوعی با یک ترانزیستور Mask ROM نشان داده می شود. در طول تولید، یک لایه فلزی میکروسکوپی حک می شود تا ترانزیستور را به صورت فیزیکی به یکی از 16 خط تولید از پیش محاسبه شده متصل کند. هنگامی که داده ها از طریق تراشه جریان می یابد، ترانزیستور به سادگی کانال صحیح از پیش محاسبه شده را انتخاب می کند و نتیجه را به جمع کننده ارسال می کند. در اصل، مدار هم حافظه و هم پردازنده است.

به گفته این شرکت، نتیجه خیره کننده است: تراشه HC1 می تواند تقریباً 16000 تا 17000 توکن در ثانیه برای هر کاربر تولید کند. این رویکرد یادآور Groq LPU است که به طور مشابه وزن‌های مدل هوش مصنوعی را مستقیماً در SRAM سریع روی تراشه می‌سازد تا از تنگنای حافظه عبور کند.

The Catch: تراشه ای که برای یک مدل ساخته شده است

مبادله قابل توجه است. از آنجایی که وزن های مدل به صورت فیزیکی در سیلیکون حک شده است، هر تراشه Taalas فقط برای مدل خاصی که برای آن طراحی شده است کار می کند. این یک شتاب دهنده قابل برنامه ریزی و همه منظوره نیست. این باعث می شود که این پیشنهاد اساساً متفاوت از یک GPU باشد که می تواند هر مدلی را که در حافظه خود بارگذاری شده است اجرا کند.

تحلیلگران صنعت حدس می‌زنند که فناوری Taalas می‌تواند به‌عنوان یک شتاب‌دهنده رمزگشایی اختصاصی در سیستم‌های بزرگ‌تر AMD در مقیاس رک عمل کند - مرحله دوم استنتاج حساس به تأخیر را مدیریت می‌کند - در حالی که سخت‌افزار انعطاف‌پذیرتر مانند سیستم Helios با انرژی مغزی، فاز پیش‌پر را کنترل می‌کند. AMD هنوز جزئیات دقیقی را ارائه نکرده است که تراشه های Taalas در نقشه راه محصول خود کجا قرار می گیرند.

چه کسی تاالاس را ساخت

Taalas در سال 2023 توسط سه نفر از کارمندان و رهبران سابق AMD در Tenstorrent، سازنده تراشه‌های هوش مصنوعی مستقر در سانتا کلارا در تورنتو تأسیس شد. تیم موسس شامل مدیر عامل شرکت Ljubisa Bajic، یکی از بنیانگذاران و مدیر اجرایی سابق، مدیر ارشد فناوری، و رئیس Tenstorrent است. مدیر اجرایی لژلا باجیچ؛ و مدیر ارشد فناوری دراگو ایگناتوویچ.

این شرکت در سال 2024 از مخفی کاری بیرون آمد و 50 میلیون دلار سرمایه از سوی Quiet Capital و سرمایه گذار کهنه کار نیمه هادی پیر لاموند و دیگران فاش کرد. پیش از این در سال 2026، 169 میلیون دلار اضافی از گروهی شامل Fidelity را اعلام کرد. Taalas ادعا کرده است که می‌تواند یک تراشه سفارشی جدید را در کمتر از دو ماه راه‌اندازی کند، در مقایسه با استانداردهای صنعتی که اغلب تا یک یا دو سال طول می‌کشد، و شرط کرده است که می‌تواند سخت‌افزاری هزار برابر کارآمدتر از همتایان مبتنی بر نرم‌افزار تولید کند.

شرایط مالی خرید AMD فاش نشده است. معامله همچنان مشمول شرایط بسته شدن و تأییدیه نظارتی است.

چرا AMD اکنون خرید می کند

AMD Taalas را پیشگام در سیلیکون استنتاج تخصصی هوش مصنوعی توصیف کرد که فناوری آن جریان داده استنتاج هوش مصنوعی را بهینه می کند و به طور قابل توجهی گلوگاه های محاسباتی و حافظه مرتبط با معماری های همه منظوره را کاهش می دهد.

وامسی بوپانا، معاون ارشد گروه هوش مصنوعی AMD در بیانیه‌ای گفت: «تیم فنی و مهندسی کلاس جهانی Taalas با ارائه عملکرد و کارایی استنتاج متفاوت، مجموعه هوش مصنوعی ما را تقویت می‌کند.

معامله الگوی گسترده تری را گسترش می دهد. توافق قبلی AMD با Cerebras، موتور مقیاس ویفر دومی را در سیستم مقیاس رک Helios ادغام می‌کند، که حجم عظیمی از حافظه و محاسبات را روی یک صفحه سیلیکونی به هم پیوسته قرار می‌دهد. افزودن Taalas به AMD سومین سلاح متمایز را در زرادخانه استنتاج خود در کنار پردازنده‌های گرافیکی Instinct خود و مشارکت Cerebras می‌دهد.

برای AMD، جذابیت واضح است. انویدیا همچنان بر آموزش و استنتاج هوش مصنوعی با اکوسیستم GPU خود تسلط دارد و رقبا برای رقابت در محاسبات همه منظوره تلاش کرده اند. AMD با خرید شرکت‌هایی با معماری‌های اساسی متفاوت - موتورهای در مقیاس ویفر، سیلیکون مدل‌های سیم‌کشی شده - شرط می‌بندد که سخت‌افزار تخصصی جایگاه‌های سودآوری را ایجاد می‌کند که پردازنده‌های گرافیکی یک‌اندازه انویدیا نمی‌توانند به همان اندازه کارآمد عمل کنند.

بازار استنتاج در حال تغییر

این خرید همچنین از تغییر صنعت گسترده تر صحبت می کند. همانطور که مدل‌های هوش مصنوعی بزرگ‌تر می‌شوند و هزینه‌های استنتاج افزایش می‌یابد، اقتصاد اجرای آن‌ها روی GPUهای همه منظوره تحت فشار قرار می‌گیرد. تراشه‌های استنتاج تخصصی کاهش هزینه‌های چشمگیر را برای استقرار با حجم بالا، که در آن مدل‌های مشابه میلیون‌ها بار اجرا می‌شود، نوید می‌دهند.

اگر AMD بتواند رویکرد سخت سیمی Taalas را با موفقیت تجاری‌سازی کند، می‌تواند به ارائه‌دهندگان و شرکت‌های ابری راهی برای اجرای مدل‌های محبوب با کسری از هزینه و تأخیر پردازنده‌های گرافیکی سنتی ارائه دهد - مشروط بر اینکه آنها مایل به متعهد شدن به سیلیکون ساخته شده بر اساس یک مدل واحد باشند.

جلوتر از جنگ تراشه ها باشید

نبرد برای برتری سخت‌افزاری هوش مصنوعی در حال تشدید است و هر خریدی تعادل قدرت را تغییر می‌دهد. آخرین پیشرفت‌های هوش مصنوعی ما را برای غواصی عمیق در سیلیکون که نسل بعدی هوش را هدایت می‌کند دنبال کنید.

بیشتر بخوانید اخبار هوش مصنوعی →