AMD و Cerebras Systems از یک همکاری فنی برای ایجاد نوع جدیدی از زیرساخت های استنتاج هوش مصنوعی پرده برداری کرده اند که پلت فرم Helios در مقیاس رک AMD را با موتور مقیاس ویفر (WSE) Cerebras در یک گردش کاری مجزا و تفکیک شده ترکیب می کند. این همکاری که در رویداد Advancing AI 2026 AMD در 23 ژوئیه 2026 اعلام شد، هدف مستقیمی از تنگناهای تاخیر و توان عملیاتی است که استنتاج را به یکی از گران ترین مشکلات در عصر هوش مصنوعی مولد تبدیل کرده است. برای اطلاع از آخرین اخبار در مورد این گوشه پر سرعت صنعت، پوشش [اخبار فوری هوش مصنوعی] (https://aibuzzwire.news) ما را دنبال کنید.

ایده اصلی این است که از مجبور کردن یک تراشه به انجام همه کارها خودداری کنید. در یک پشته استنتاج سنتی، یک خانواده واحد پردازنده گرافیکی هم کار سنگین پیش پر کردن هضم یک دستور و هم کار ظریف و متوالی تولید هر توکن جدید را انجام می دهد. این یک سازش است، زیرا این دو شغل خواسته های بسیار متفاوتی دارند. AMD و Cerebras استدلال می کنند که تقسیم کار، تکنیکی که به عنوان استنتاج تفکیک شده شناخته می شود، به هر موتور اجازه می دهد بهترین کار را انجام دهد.

چگونه دو موتور کار را تقسیم می کنند

طبق اعلام رسمی AMD، AMD Helios به عنوان موتور توان عملیاتی با کارایی بالا و مقیاس‌پذیر عمل می‌کند که از پردازنده‌های گرافیکی AMD Instinct برای پردازش سریع دسته‌های بزرگ ورودی استفاده می‌کند. در همین حال، Cerebras Wafer-Scale Engine، رمزگشایی و تولید توکن فوق سریع و با تأخیر بسیار پایین را انجام خواهد داد. تراشه‌های Cerebras بر روی ویفرهای کامل ساخته شده‌اند نه اینکه در قالب‌های تکی تکه‌ای شوند، و به آنها پهنای باند حافظه روی تراشه عظیمی می‌دهد که مخصوصاً برای پخش توکن‌ها بدون توقف مناسب است.

این شرکت‌ها می‌گویند که با ترکیب این دو موتور محاسباتی، انتظار می‌رود راه‌حل مشترک تا 5 برابر توکن‌های بالاتر در هر ثانیه در هر وات ارائه کند، معیاری که به یک کارت امتیازی مرکزی برای اقتصاد استنتاج تبدیل شده است زیرا ارائه‌دهندگان بر سر هزینه‌های سرعت و انرژی رقابت می‌کنند. این رقم در بیانیه مطبوعاتی AMD ذکر شد و در سراسر رسانه ها از جمله Tom's Hardware، Investing.com و Yahoo Tech گزارش شد.

ضربه ای به تسلط انویدیا

مشارکت نیز یک سیگنال استراتژیک است. اکوسیستم CUDA انویدیا و مجموعه پردازنده گرافیکی در حال حاضر بر آموزش و استنتاج هوش مصنوعی تسلط دارند، و رقبا به طور فزاینده ای به این نتیجه رسیده اند که شکست دادن پیشرو در یک معماری واحد دشوار است. Business Insider این قرارداد را در شرایطی تعریف کرد که AMD با شرط بندی بر روی استنتاج، مرحله محاسبات هوش مصنوعی را با سرعت بیشتری به رشد مدل ها از توسعه به تولید تبدیل می کند.

برای AMD، جفت شدن با Cerebras جذابیت نقشه راه Instinct و Helios را فراتر از آموزش گسترش می دهد. برای Cerebras که در Nasdaq تحت علامت CBRS در کنار AMD (NASDAQ: AMD) معامله می‌کند، ادغام با یک فروشنده اصلی شتاب‌دهنده، به فناوری مقیاس ویفر آن مسیر روشن‌تری را برای استقرار شرکت‌های بزرگ و ابری می‌دهد. سربراس قصد دارد AMD Helios را در مراکز داده خود مستقر کند و شرکت ها انتظار دارند که راه حل مشترک ابتدا از طریق Cerebras Cloud در نیمه دوم سال 2026 در دسترس باشد.

چرا تفکیک در حال حاضر مهم است

هزینه های استنتاج به یک نقطه فشار تعیین کننده برای صنعت هوش مصنوعی تبدیل شده است. همانطور که مدل‌ها بزرگتر می‌شوند و برنامه‌ها پاسخ‌های بلادرنگ را می‌طلبند، هزینه تولید هر توکن، و تجربه تاخیر کاربران در انتظار آن، می‌تواند تعیین کند که آیا یک محصول قابل دوام است یا خیر. استنتاج تفکیک‌شده، پیش‌پر کردن و رمزگشایی را به‌عنوان بارهای کاری جداگانه در نظر می‌گیرد که می‌توان آن‌ها را به سخت‌افزاری هدایت کرد که به بهترین وجه با هر کدام مطابقت دارد، فلسفه طراحی که شرکت‌هایی مانند Cerebras بیش از یک سال از آن دفاع کرده‌اند.

اعلامیه AMD-Cerebras نشان می دهد که رویکرد از یک ایده شورشی به یک معماری مورد تایید صنعت در حال حرکت است. با جفت کردن یک متخصص توان عملیاتی با یک متخصص تاخیر، این دو شرکت شرط می‌بندند که آینده استنتاج یک تراشه نیست که همه آنها را اداره کند، بلکه یک سیستم هماهنگ از موتورهای تخصصی است.

چه چیزی را تماشا کنیم

چند سوال باقی مانده است. رقم 5 برابر توکن در ثانیه به ازای هر وات یک انتظار است تا یک معیار شخص ثالث، و عملکرد دنیای واقعی به مدل‌ها و حجم کاری خاصی که مشتریان اجرا می‌کنند بستگی دارد. جزئیات قیمت و در دسترس بودن فراتر از راه اندازی Cerebras Cloud فاش نشده است، و مشخص نیست چه زمانی این راه حل ممکن است به سایر ارائه دهندگان ابری برسد.

با این حال، این معامله بر تغییر گسترده‌تری در سخت‌افزار هوش مصنوعی تاکید می‌کند: این فرض که یک معماری واحد پردازش گرافیکی واحد در هر مرحله از خط لوله هوش مصنوعی خدمت می‌کند، در حال خراب شدن است. اگر AMD و Cerebras بتوانند ادعاهای کارایی خود را ارائه دهند، استنتاج تفکیک شده می تواند به بخشی استاندارد از نحوه ساخت بزرگترین سیستم های هوش مصنوعی تبدیل شود.

از هوش مصنوعی جلوتر بمانید

چشم انداز سخت افزاری هوش مصنوعی به اردوگاه های تخصصی تقسیم می شود و پیامدهای آن برای هزینه، سرعت و رقابت بسیار زیاد است. [اخبار هوش مصنوعی را بیشتر بخوانید] (https://aibuzzwire.news) در AI Buzz Wire تا از هر معامله، نسخه و معیار مهمی مطلع شوید.