В этом году Intel открыла конференцию Hot Chips с глубокого погружения в Crescent Island, графический процессор для центров обработки данных, на который она делает ставку для следующего этапа рабочих нагрузок ИИ: агентного вывода. Доклад, представленный главным архитектором корпоративных систем искусственного интеллекта Сумитом Моханом и научным сотрудником Intel Хун Цзяном, был сосредоточен на трех показателях, которые, по словам компании, определяют агентную эру: количество токенов на ватт, большой объем памяти и открытый стек программного обеспечения.
Время имеет значение. Nvidia использовала ту же конференцию для подробного описания своей стоечной системы Vera Rubin NVL72, и каждый поставщик ускорителей на Hot Chips 2026 теперь презентует эффективность, а не чистую пиковую производительность. Ответ Intel — это часть, которая заменяет технологию памяти, используемую основными графическими процессорами AI, на что-то более дешевое за гигабайт, и это приводит к поразительным цифрам в заголовках. Подробнее об этой истории — в нашем больше статей об ИИ.
Карта PCIe емкостью 480 ГБ и мощностью 350 Вт.
Crescent Island — это графический процессор PCIe с воздушным охлаждением мощностью 350 Вт. Фирменная карта Intel поставляется с 160 ГБ памяти LPDDR5X, но ее конструкция позволяет партнерам ODM создавать варианты с объемом памяти до 480 ГБ — примерно в три раза больше емкости типичных высокопроизводительных карт-ускорителей, и этого достаточно для хранения очень больших KV-кэшей для долгосрочных и многосессионных агентских рабочих нагрузок. Проект охватывает типы данных от FP4 и MXFP4 до FP64.
Выбор памяти — это стратегическое решение в продукте. LPDDR5X обменивает пропускную способность на емкость и стоимость, что соответствует профилю рабочей нагрузки, где огромные контекстные окна и циклы вызова инструментов потребляют объем памяти больше, чем необработанные вычисления. Intel строит всю конструкцию вокруг «токенов на ватт» — обеспечивая более полезную мощность на единицу энергии, а не выигрывая в сравнениях пиковых FLOPS.
Xe3P Silicon: 32 ядра, 256 процессоров XMX
Под капотом Crescent Island — архитектура Intel Xe3P, и Intel представила ее как скачок в поколение по сравнению с поколением Xe2 на базе Battlemage. Там, где Xe2 предлагал 20 ядер Xe и систолический массив XMX с 4 глубинами, Crescent Island предлагает 32 ядра Xe и систолический массив с 16 глубинами, всего питая 256 двигателей XMX.
Расширения Xe Matrix Extensions третьего поколения добавляют трехстороннюю расширенную матрицу Xe с прецизионным совместным выпуском FP4 и поддержкой FP64. Каждое ядро Xe содержит файл общего регистра размером 1 МБ и 512 КБ кэш-памяти L1, а также 32 МБ унифицированного кэша L2, общего для всего устройства. Медиа-движок с четырьмя декодерами и четырьмя кодировщиками расположен рядом, а вся SoC подключается через PCIe Gen5 x16 с поддержкой масштабирования через открытую коммутационную структуру. Intel указывает активную мощность в режиме ожидания 50 Вт или меньше в состоянии G0 и примерно 10 Вт в состоянии G8 с низким энергопотреблением, что достигается за счет распределенных доменов питания, пакетных маршрутизаторов сети на кристалле с агрессивным стробированием тактовой частоты и независимых шин DVFS для графики и мультимедиа.
Функции RAS, заимствованные из руководства по серверам
Что касается центра обработки данных, проектированию надежности уделяется столько же времени, сколько и пропускной способности - тема, которую Nvidia также использовала в работе с Верой Рубин. Crescent Island обеспечивает ECC и контроль четности в ключевых структурах памяти, проверку ошибок на каждом этапе внутренней структуры межсоединений, динамическое отключение страниц, жесткое восстановление после пакета и расширенную отчетность об ошибках PCI Express. Intel заявляет, что эта комбинация сокращает вероятность скрытого повреждения данных — режима сбоя, который наиболее важен для длительного автоматического вывода.
Intel также поместила эту деталь в портфолио, которое простирается от графических процессоров Arc Pro для рабочих станций до приобретенных ею RDU SambaNova SN50, причем Crescent Island занимает первое место в качестве якоря корпоративного центра обработки данных. Компания продемонстрировала дорожную карту, насчитывающую более шести лет, назвав графический процессор зрелой конструкцией третьего поколения, а не первой попыткой. Карта была впервые представлена на выставке Computex в июне; Hot Chips представили архитектурные детали, стоящие за этим.
Почему агентный вывод предпочитает этот дизайн
Аргумент о рабочей нагрузке — самая интересная часть презентации Intel. Агентический ИИ — модели, которые объединяют вызовы инструментов, удерживают длинные контексты открытыми и координируют работу ЦП и ГП — одновременно учитывают задержку, объем памяти и пропускную способность системы, а не профиль пакетной пропускной способности обслуживания чат-бота. Емкость KV-кэша для длинных контекстов и одновременных сеансов в сжатом домене явно встроена в конструкцию SoC.
Эта формулировка также объясняет ставку на LPDDR5X. Если следующей волной вычислений ИИ станут агенты, требующие большого объема памяти, а не обучающие программы, карта емкостью 480 ГБ и мощностью 350 Вт станет надежной альтернативой компонентам премиум-класса на базе HBM — при условии, что стек программного обеспечения обеспечит их. Акцент Intel на открытом стеке и открытой коммутационной фабрике направлен непосредственно на покупателей, опасающихся привязанности к интегрированной платформе Nvidia.
Crescent Island не заменит ускорители обучения, которые доминируют в заголовках новостей об искусственном интеллекте, и Intel не раскрыла цены или доступность на конференции. Но как заявление о том, в каком направлении, по мнению Intel, происходит вывод — толстая память, экономичная мощность, открытая структура — это одна из наиболее ясных историй об архитектуре Hot Chips этого года.
---
Будьте в курсе ИИПоследние новости, аналитика и прорывы в сфере ИИ — всё в одном месте.
Читать больше новостей об ИИ →