OpenAI опубликовала первые результаты тестов для своего собственного чипа вывода Jalapeño, и цифры поражают: в тесте InferenceX компании SemiAnalysis новый процессор зарегистрировал как больше токенов на пользователя, так и большую пропускную способность на киловатт, чем доступные в настоящее время современные процессоры вывода — сравнение, включающее системы Nvidia Blackwell. Результаты были представлены во вторник на конференции Hot Chips в Пало-Альто, наряду с подробным техническим обзором того, как был построен чип. Для читателей, следящих за гонкой вычислений, которая лежит в основе каждого [выпуска модели искусственного интеллекта] (https://aibuzzwire.news), это одна из наиболее важных данных об аппаратном обеспечении года.

«Суть в том, что результаты показывают очень, очень значительный прирост производительности по сравнению с современными решениями», — сказал Ричард Хо, руководитель аппаратного обеспечения OpenAI, в пресс-конференции, о которой сообщил TechCrunch. «Халапеньо может выполнять больше работы ИИ на единицу мощности, а также быстрее возвращать ответы. Он очень эффективен для обслуживания большого количества клиентов, но при этом может иметь очень низкую задержку».

Чип, созданный для полного конвейера вывода

Jalapeño был представлен в июне 2026 года как первый специализированный чип OpenAI, разработанный в тесном сотрудничестве с Broadcom, при этом собственные модели искусственного интеллекта OpenAI помогали в процессе разработки чипа. Само партнерство началось в октябре 2025 года, когда OpenAI вместе с сетевым гигантом представила планы по созданию специальной программы акселератора для нескольких поколений.

Что отличает Jalapeño от графического процессора общего назначения, по мнению OpenAI, так это то, что он был разработан с учетом моделей, которые он будет обслуживать. Поскольку компания контролирует весь стек — продукты искусственного интеллекта, модели, чипы и память — ее инженеры смогли атаковать конкретные этапы процесса вывода, которые часто вызывают разногласия.

В частности, Jalapeño предназначен для минимизации задержек на этапах предварительного заполнения и связи, которые, по словам OpenAI, часто становятся узкими местами при обслуживании больших языковых моделей в масштабе.

«Мы разработали Jalapeño, чтобы минимизировать перемещение данных и задержки связи», — написала компания в сообщении в блоге, представляя результаты. «Это означает, что состояние модели, включая кэш KV, используемый при генерации ответа, может быть явно размещено и сохранено локально, пока система активирует правильное сочетание вычислений, памяти и сети для каждой фазы вывода».

Последний пункт важен для всех, кто выполняет рабочие нагрузки ИИ. Кэш KV — накопленный контекст, который модель хранит при генерации ответа — является одной из самых больших проблем с памятью и пропускной способностью в современном логическом выводе. Сохранение его локальным и явным управлением вместо его перетасовки по кластеру — это классический способ сократить задержки и снизить энергопотребление.

Лучше, чем Блэквелл — на данный момент

Сравнение в заголовке проводится с системой Nvidia Blackwell, которая в настоящее время является рабочей лошадкой в области передового искусственного интеллекта. Независимый анализ, опубликованный в тот же день SemiAnaанализом под названием «OpenAI Jalapeño: лучше, чем Nvidia Blackwell», пришел к аналогичному выводу о первых результатах чипа, и эта история быстро стала одной из самых обсуждаемых статей на Hacker News.

Но руководители и аналитики OpenAI призывают к осторожности. Хо подсчитал, что Jalapeño будет развернут в конце 2026 года «в очень небольших объемах», а более значительное развертывание произойдет в 2027 году. К тому времени, когда Jalapeño достигнет полного масштаба, конкуренция, возможно, значительно продвинется — дорожная карта Nvidia продолжает меняться, и другие гипермасштабирующие компании, включая Google, Amazon и Microsoft, продвигают свои собственные специализированные микросхемы.

Как отмечает TechCrunch, тесты, сравниваемые с сегодняшним уровнем техники, являются моментальным снимком, а не гарантией. Чип, который выиграет по эффективности в 2026 году, должен продолжать выигрывать у того, что Nvidia и ее конкуренты представят в следующем году.

Почему OpenAI создает собственный кремний

Стратегическая логика проста: вывод — это самые большие текущие затраты OpenAI. Каждый запрос ChatGPT, каждый вызов API и каждая агентская задача потребляют вычислительные ресурсы, а аренда этих вычислительных ресурсов у Nvidia по рыночным ценам снижает прибыль по мере масштабирования использования. Специальный чип, настроенный на собственные модели OpenAI, разработанный совместно с Broadcom и сформированный на основе самих моделей OpenAI, дает компании возможность обслуживать больше пользователей на ватт и доллар.

Халапеньо также планируется как платформа для нескольких поколений, а не как разовая часть. OpenAI заявила, что намерена совместно разрабатывать продукты, модели, чипы и память для искусственного интеллекта, чтобы каждое поколение кремния было оптимизировано совместно с моделями, на которых оно будет работать. Если результаты первого поколения сохранятся в производстве, Халапеньо станет образцом для всего последующего.

Ставки выходят за рамки OpenAI. Доминирование Nvidia в области ускорителей искусственного интеллекта было самым узким местом в отрасли в течение трех лет, и каждая заслуживающая доверия альтернатива — будь то команда TPU Google, Amazon или теперь OpenAI — меняет переговорный ландшафт для всех, кто строит инфраструктуру искусственного интеллекта. Сообщается, что сама Nvidia предупреждает клиентов о повышении цен на ИИ-серверы на 15 и более процентов по мере роста стоимости памяти, что только повышает привлекательность собственных альтернатив.

Что будет дальше

На данный момент «Халапеньо» остается предсерийной частью с многообещающими цифрами на бумаге. Настоящее испытание наступит в конце 2026 года, когда будут развернуты первые небольшие объемы, и особенно в 2027 году, когда OpenAI ожидает значительного масштабирования. Ключевые вопросы остаются без ответа: реальная надежность в масштабе центра обработки данных, общая стоимость владения по сравнению с арендованными мощностями Blackwell и сохранится ли преимущество в эффективности по сравнению со следующим поколением Nvidia.

Тем не менее, первые тесты знаменуют собой важную веху: впервые одна из крупных лабораторий искусственного интеллекта публично продемонстрировала специальный кремний для вывода, который, по-видимому, превосходит лучшие результаты действующего производителя по эффективности. Для отрасли, которая рассматривает поставки Nvidia как стратегическую линию жизни, это настоящий переломный момент.

---

Будьте впереди ИИ

Получайте последние новости, анализ и открытия в области искусственного интеллекта — все в одном месте.

Подробнее новости AI →