AMD и Cerebras Systems объявили о техническом партнерстве для создания нового типа инфраструктуры вывода искусственного интеллекта, объединяющего стоечную платформу Helios от AMD и Wafer-Scale Engine (WSE) от Cerebras в едином дезагрегированном рабочем процессе. Сотрудничество, о котором было объявлено на мероприятии AMD Advancing AI 2026 23 июля 2026 года, направлено непосредственно на устранение задержек и узких мест в пропускной способности, которые сделали логический вывод одной из самых дорогостоящих проблем в эпоху генеративного искусственного интеллекта. Чтобы быть в курсе последних новостей об этом быстро развивающемся секторе отрасли, следите за нашими [последними новостями об искусственном интеллекте] (https://aibuzzwire.news).
Основная идея состоит в том, чтобы перестать заставлять один чип делать все. В традиционном стеке вывода одно семейство графических процессоров выполняет как тяжелую работу по предварительному заполнению по обработке приглашения, так и тонкую последовательную работу по созданию каждого нового токена. Это компромисс, потому что у этих двух профессий совершенно разные требования. AMD и Cerebras утверждают, что разделение работы — метод, известный как дезагрегированный вывод, — позволяет каждому механизму делать то, что он делает лучше всего.
Как два двигателя делят труд
Согласно официальному заявлению AMD, AMD Helios будет служить высокопроизводительным механизмом с масштабируемой пропускной способностью, использующим графические процессоры AMD Instinct для быстрой обработки больших пакетов входных данных. Тем временем Cerebras Wafer-Scale Engine будет обеспечивать сверхбыстрое декодирование со сверхмалой задержкой и генерацию токенов. Чипы Cerebras построены на целых пластинах, а не на отдельных кристаллах, что обеспечивает им огромную пропускную способность встроенной памяти, которая особенно хорошо подходит для потоковой передачи токенов без остановок.
Компании заявляют, что, объединив два вычислительных механизма, совместное решение, как ожидается, будет обеспечивать в 5 раз больше токенов в секунду на ватт, и этот показатель стал центральной оценкой для экономических выводов, поскольку поставщики конкурируют как по скорости, так и по затратам на электроэнергию. Эта цифра была приведена в пресс-релизе AMD и опубликована в таких изданиях, как Tom's Hardware, Investing.com и Yahoo Tech.
Удар по доминированию Nvidia
Партнерство также является стратегическим сигналом. Экосистема CUDA и линейка графических процессоров Nvidia в настоящее время доминируют в обучении и выводе ИИ, и претенденты все чаще приходят к выводу, что победить действующего лидера на одной архитектуре сложно. Business Insider описал сделку как попытку AMD попытаться обойти Nvidia, сделав ставку на логический вывод — фазу вычислений на базе искусственного интеллекта, которая, как ожидается, будет расти быстрее всего по мере перехода моделей от разработки к производству.
Для AMD объединение с Cerebras расширяет привлекательность ее дорожной карты Instinct и Helios, выходя за рамки обучения. Для компании Cerebras, которая торгуется на Nasdaq под тикером CBRS наряду с AMD (NASDAQ: AMD), интеграция с крупным поставщиком ускорителей дает ее технологии масштаба пластины более четкий путь к крупным предприятиям и облачным развертываниям. Cerebras планирует развернуть AMD Helios в собственных центрах обработки данных, и компании ожидают, что совместное решение будет доступно сначала через Cerebras Cloud во второй половине 2026 года.
Почему дезагрегирование важно сейчас
Затраты на логические выводы стали определяющей точкой давления для индустрии искусственного интеллекта. По мере того, как модели становятся больше, а приложения требуют ответов в режиме реального времени, стоимость генерации каждого токена и задержка, с которой сталкиваются пользователи в ожидании его, могут определять жизнеспособность продукта. Дезагрегированный вывод рассматривает предварительное заполнение и декодирование как отдельные рабочие нагрузки, которые можно перенаправить на оборудование, наиболее подходящее для каждой из них. Эту философию проектирования такие компании, как Cerebras, отстаивают уже более года.
Заявление AMD-Cerebras предполагает, что подход переходит от бунтарской идеи к архитектуре, одобренной отраслью. Объединив специалиста по пропускной способности и специалиста по задержкам, обе компании делают ставку на то, что будущее логического вывода — это не один чип, который будет управлять ими всеми, а скоординированная система специализированных механизмов.
Что посмотреть
Остается несколько вопросов. Показатель 5x токенов в секунду на ватт является ожидаемым, а не сторонним тестом, и реальная производительность будет зависеть от конкретных моделей и рабочих нагрузок, которые используют клиенты. Подробности о ценах и доступности после запуска Cerebras Cloud не разглашаются, и неясно, когда решение может появиться у других облачных провайдеров.
Тем не менее, сделка подчеркивает более широкий сдвиг в аппаратном обеспечении искусственного интеллекта: предположение о том, что одна архитектура графического процессора будет обслуживать каждый этап конвейера искусственного интеллекта, теряет свою актуальность. Если AMD и Cerebras смогут оправдать свои заявления об эффективности, дезагрегированный вывод может стать стандартной частью построения крупнейших систем искусственного интеллекта.
Будьте впереди ИИ
Сфера аппаратного обеспечения искусственного интеллекта разделяется на специализированные лагеря, и последствия для стоимости, скорости и конкуренции огромны. Читайте больше новостей об искусственном интеллекте на AI Buzz Wire, чтобы быть в курсе всех крупных сделок, релизов и тестов.


