AMD و Cerebras Systems از یک همکاری فنی برای ایجاد نوع جدیدی از زیرساخت های استنتاج هوش مصنوعی پرده برداری کرده اند که پلت فرم Helios در مقیاس رک AMD را با موتور مقیاس ویفر (WSE) Cerebras در یک گردش کاری مجزا و تفکیک شده ترکیب می کند. این همکاری که در رویداد Advancing AI 2026 AMD در 23 ژوئیه 2026 اعلام شد، هدف مستقیمی از تنگناهای تاخیر و توان عملیاتی است که استنتاج را به یکی از گران ترین مشکلات در عصر هوش مصنوعی مولد تبدیل کرده است. برای اطلاع از آخرین اخبار در مورد این گوشه پر سرعت صنعت، پوشش [اخبار فوری هوش مصنوعی] (https://aibuzzwire.news) ما را دنبال کنید.
ایده اصلی این است که از مجبور کردن یک تراشه به انجام همه کارها خودداری کنید. در یک پشته استنتاج سنتی، یک خانواده واحد پردازنده گرافیکی هم کار سنگین پیش پر کردن هضم یک دستور و هم کار ظریف و متوالی تولید هر توکن جدید را انجام می دهد. این یک سازش است، زیرا این دو شغل خواسته های بسیار متفاوتی دارند. AMD و Cerebras استدلال می کنند که تقسیم کار، تکنیکی که به عنوان استنتاج تفکیک شده شناخته می شود، به هر موتور اجازه می دهد بهترین کار را انجام دهد.
چگونه دو موتور کار را تقسیم می کنند
طبق اعلام رسمی AMD، AMD Helios به عنوان موتور توان عملیاتی با کارایی بالا و مقیاسپذیر عمل میکند که از پردازندههای گرافیکی AMD Instinct برای پردازش سریع دستههای بزرگ ورودی استفاده میکند. در همین حال، Cerebras Wafer-Scale Engine، رمزگشایی و تولید توکن فوق سریع و با تأخیر بسیار پایین را انجام خواهد داد. تراشههای Cerebras بر روی ویفرهای کامل ساخته شدهاند نه اینکه در قالبهای تکی تکهای شوند، و به آنها پهنای باند حافظه روی تراشه عظیمی میدهد که مخصوصاً برای پخش توکنها بدون توقف مناسب است.
این شرکتها میگویند که با ترکیب این دو موتور محاسباتی، انتظار میرود راهحل مشترک تا 5 برابر توکنهای بالاتر در هر ثانیه در هر وات ارائه کند، معیاری که به یک کارت امتیازی مرکزی برای اقتصاد استنتاج تبدیل شده است زیرا ارائهدهندگان بر سر هزینههای سرعت و انرژی رقابت میکنند. این رقم در بیانیه مطبوعاتی AMD ذکر شد و در سراسر رسانه ها از جمله Tom's Hardware، Investing.com و Yahoo Tech گزارش شد.
ضربه ای به تسلط انویدیا
مشارکت نیز یک سیگنال استراتژیک است. اکوسیستم CUDA انویدیا و مجموعه پردازنده گرافیکی در حال حاضر بر آموزش و استنتاج هوش مصنوعی تسلط دارند، و رقبا به طور فزاینده ای به این نتیجه رسیده اند که شکست دادن پیشرو در یک معماری واحد دشوار است. Business Insider این قرارداد را در شرایطی تعریف کرد که AMD با شرط بندی بر روی استنتاج، مرحله محاسبات هوش مصنوعی را با سرعت بیشتری به رشد مدل ها از توسعه به تولید تبدیل می کند.
برای AMD، جفت شدن با Cerebras جذابیت نقشه راه Instinct و Helios را فراتر از آموزش گسترش می دهد. برای Cerebras که در Nasdaq تحت علامت CBRS در کنار AMD (NASDAQ: AMD) معامله میکند، ادغام با یک فروشنده اصلی شتابدهنده، به فناوری مقیاس ویفر آن مسیر روشنتری را برای استقرار شرکتهای بزرگ و ابری میدهد. سربراس قصد دارد AMD Helios را در مراکز داده خود مستقر کند و شرکت ها انتظار دارند که راه حل مشترک ابتدا از طریق Cerebras Cloud در نیمه دوم سال 2026 در دسترس باشد.
چرا تفکیک در حال حاضر مهم است
هزینه های استنتاج به یک نقطه فشار تعیین کننده برای صنعت هوش مصنوعی تبدیل شده است. همانطور که مدلها بزرگتر میشوند و برنامهها پاسخهای بلادرنگ را میطلبند، هزینه تولید هر توکن، و تجربه تاخیر کاربران در انتظار آن، میتواند تعیین کند که آیا یک محصول قابل دوام است یا خیر. استنتاج تفکیکشده، پیشپر کردن و رمزگشایی را بهعنوان بارهای کاری جداگانه در نظر میگیرد که میتوان آنها را به سختافزاری هدایت کرد که به بهترین وجه با هر کدام مطابقت دارد، فلسفه طراحی که شرکتهایی مانند Cerebras بیش از یک سال از آن دفاع کردهاند.
اعلامیه AMD-Cerebras نشان می دهد که رویکرد از یک ایده شورشی به یک معماری مورد تایید صنعت در حال حرکت است. با جفت کردن یک متخصص توان عملیاتی با یک متخصص تاخیر، این دو شرکت شرط میبندند که آینده استنتاج یک تراشه نیست که همه آنها را اداره کند، بلکه یک سیستم هماهنگ از موتورهای تخصصی است.
چه چیزی را تماشا کنیم
چند سوال باقی مانده است. رقم 5 برابر توکن در ثانیه به ازای هر وات یک انتظار است تا یک معیار شخص ثالث، و عملکرد دنیای واقعی به مدلها و حجم کاری خاصی که مشتریان اجرا میکنند بستگی دارد. جزئیات قیمت و در دسترس بودن فراتر از راه اندازی Cerebras Cloud فاش نشده است، و مشخص نیست چه زمانی این راه حل ممکن است به سایر ارائه دهندگان ابری برسد.
با این حال، این معامله بر تغییر گستردهتری در سختافزار هوش مصنوعی تاکید میکند: این فرض که یک معماری واحد پردازش گرافیکی واحد در هر مرحله از خط لوله هوش مصنوعی خدمت میکند، در حال خراب شدن است. اگر AMD و Cerebras بتوانند ادعاهای کارایی خود را ارائه دهند، استنتاج تفکیک شده می تواند به بخشی استاندارد از نحوه ساخت بزرگترین سیستم های هوش مصنوعی تبدیل شود.
از هوش مصنوعی جلوتر بمانید
چشم انداز سخت افزاری هوش مصنوعی به اردوگاه های تخصصی تقسیم می شود و پیامدهای آن برای هزینه، سرعت و رقابت بسیار زیاد است. [اخبار هوش مصنوعی را بیشتر بخوانید] (https://aibuzzwire.news) در AI Buzz Wire تا از هر معامله، نسخه و معیار مهمی مطلع شوید.


