OpenAI опублікував перші результати порівняльного тесту для Jalapeño, свого спеціального чіпа виводу, і цифри вражають: у тесті InferenceX від SemiAnalysis новий кремній зареєстрував як більше токенів на користувача, так і більшу пропускну здатність на кіловат, ніж доступні на даний момент найсучасніші процесори виведення — порівняння включає системи Blackwell від Nvidia. Результати були представлені у вівторок на конференції Hot Chips у Пало-Альто разом із детальним технічним оглядом того, як був побудований чіп. Для читачів, які відстежують обчислювальну гонку, яка лежить в основі кожного [випуску моделі штучного інтелекту] (https://aibuzzwire.news), це одна з найбільш важливих апаратних даних року.
«Суть полягає в тому, що результати показують дуже, дуже значне підвищення продуктивності в порівнянні з сучасним обладнанням», — сказав Річард Хо, керівник апаратного забезпечення OpenAI, у прес-конференції, про яку повідомляє TechCrunch. «Jalapeño може обслуговувати більше роботи штучного інтелекту на одиницю потужності, а також швидше повертати відповіді. Це дуже ефективно, щоб обслуговувати багато клієнтів, але також може мати дуже низьку затримку».
Мікросхема, створена для повного конвеєра висновків
Jalapeño був представлений у червні 2026 року як перший власний кремній OpenAI, розроблений у тісній співпраці з Broadcom, з власними моделями штучного інтелекту OpenAI, які допомагають у процесі розробки чіпа. Саме партнерство бере свій початок у жовтні 2025 року, коли OpenAI разом із мережевим гігантом виклав плани щодо спеціальної програми прискорення для кількох поколінь.
За словами OpenAI, Jalapeño відрізняється від графічного процесора загального призначення тим, що він розроблений відповідно до моделей, які він обслуговуватиме. Оскільки компанія контролює весь стек — продукти штучного інтелекту, моделі, мікросхеми та пам’ять — її інженери змогли атакувати певні фази процесу логічного висновку, які часто викликають тертя.
Зокрема, Jalapeño розроблено для мінімізації затримок під час етапів попереднього заповнення та зв’язку обробки, які, за словами OpenAI, часто є вузькими місцями під час обслуговування великих мовних моделей у масштабі.
«Ми розробили Jalapeño, щоб мінімізувати переміщення даних і затримки зв’язку», — написала компанія в повідомленні в блозі, представляючи результати. «Це означає, що стан моделі, включно з кеш-пам’яттю KV, який використовується під час генерації відповіді, можна явно розмістити та зберігати локально, поки система активує правильну комбінацію обчислень, пам’яті та мережі для кожної фази висновку».
Цей останній пункт важливий для тих, хто використовує робочі навантаження штучного інтелекту. KV-кеш — накопичений контекст, який утримує модель під час генерування відповіді — є одним із найбільших головних болів пам’яті та пропускної здатності в сучасному висновку. Зберігання його локальним і чітким керуванням, а не перемішування в кластері, є класичним способом скоротити затримку та потужність.
Краще, ніж Blackwell — поки що
Заголовок порівнює з системою Nvidia Blackwell, яка наразі є робочою конячкою передових висновків ШІ. Незалежний аналіз, опублікований того ж дня SemiAnalysis під назвою «OpenAI Jalapeño: краще, ніж Nvidia Blackwell», дійшов подібного висновку щодо ранніх результатів чіпа, і ця історія швидко стала одним із найбільш обговорюваних у Hacker News.
Але керівники та аналітики OpenAI закликають до обережності. Хо оцінив, що Jalapeño буде розгорнуто наприкінці 2026 року «в дуже невеликих обсягах», а більш значне розгортання відбудеться в 2027 році. До того часу, коли Jalapeño досягне повного масштабу, конкуренція може значно просунутися — дорожня карта Nvidia продовжує рухатися, а інші гіпермасштабувальники, включаючи Google, Amazon і Microsoft, просувають власний власний кремній.
Як зазначив TechCrunch, контрольні показники, виміряні за сучасним рівнем техніки, є миттєвим знімком, а не гарантією. Чіп, який виграє в ефективності в 2026 році, повинен продовжувати вигравати проти того, що Nvidia та її конкуренти постачатимуть наступного року.
Чому OpenAI створює власний кремній
Стратегічна логіка проста: висновок є найбільшою періодичною вартістю OpenAI. Кожен запит ChatGPT, кожен виклик API і кожне агентське завдання витрачає обчислення, а оренда цього обчислювального ресурсу від Nvidia за ринковими цінами зменшує маржу як масштаб використання. Спеціальний чіп, налаштований на власні моделі OpenAI — розроблений спільно з Broadcom і сформований на основі самих моделей OpenAI — дає компанії можливість обслуговувати більше користувачів за ват і долар.
Jalapeño також планується як платформа для кількох поколінь, а не як одноразова частина. OpenAI заявив, що має намір разом розробляти продукти штучного інтелекту, моделі, чіпи та пам’ять, щоб кожне покоління кремнію було оптимізовано разом із моделями, які він запускатиме. Якщо результати першого покоління зберігаються у виробництві, Jalapeño стає зразком для всього, що буде наступним.
Ставки виходять за межі OpenAI. Домінування Nvidia щодо прискорювачів штучного інтелекту було єдиним вузьким місцем у галузі протягом трьох років, і кожна надійна альтернатива — будь то команда Google TPU, Amazon чи тепер OpenAI — змінює переговорний ландшафт для всіх, хто створює інфраструктуру штучного інтелекту. Повідомляється, що сама Nvidia попереджає клієнтів про підвищення цін на 15 і більше відсотків на сервери зі штучним інтелектом у зв’язку з різким зростанням вартості пам’яті, що лише посилює привабливість внутрішніх альтернатив.
Що буде далі
Наразі Jalapeño залишається передсерійною частиною з багатообіцяючими паперовими номерами. Справжнє випробування відбудеться в кінці 2026 року, коли будуть розгорнуті перші невеликі томи, і особливо в 2027 році, коли OpenAI очікує значного масштабу. Ключові питання залишаються без відповіді: реальна надійність у масштабі центру обробки даних, загальна вартість володіння порівняно з орендованою потужністю Blackwell і чи витримає перевага ефективності в порівнянні з наступним поколінням Nvidia.
Тим не менш, перші тести знаменують віху: вперше одна з великих лабораторій штучного інтелекту публічно продемонструвала спеціальний кремній для виводу, який, здається, перевершує найкращих за ефективністю діючих лабораторій. Для галузі, яка сприймає постачання Nvidia як стратегічний рятівний круг, це справжня точка перелому.
---
Будьте попереду ШІОтримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.
Читати більше новин AI →