OpenAI zveřejnilo první výsledky benchmarku pro Jalapeño, jeho vlastní inferenční čip, a čísla jsou ohromující: v benchmarku InferenceX společnosti SemiAnalysis zaznamenal nový křemík více tokenů na uživatele a vyšší propustnost na kilowatt než aktuálně dostupné nejmodernější inferenční procesory – srovnání, které zahrnuje systémy Blackwell společnosti Nvidia. Výsledky byly prezentovány v úterý na konferenci Hot Chips v Palo Alto spolu s podrobným technickým pohledem na to, jak byl čip vyroben. Pro čtenáře sledující výpočetní závod, který je základem každého [vydání modelu AI] (https://aibuzzwire.news), je to jeden z nejdůslednějších hardwarových datových bodů roku.

„Základem je, že výsledky ukazují velmi, velmi významný pokrok ve výkonu oproti současnému stavu techniky,“ řekl Richard Ho, ředitel hardwaru OpenAI, v tiskovém hovoru, o kterém informoval TechCrunch. "Jalapeño může obsloužit více práce umělé inteligence na jednotku výkonu a zároveň rychleji vracet odpovědi. Obsluhovat mnoho zákazníků je velmi efektivní, ale může to být také velmi nízká latence."

Čip vytvořený pro úplný inferenční kanál

Jalapeño bylo odhaleno v červnu 2026 jako první vlastní křemík OpenAI, vyvinutý v úzké spolupráci s Broadcom, s vlastními modely AI OpenAI asistujícími v procesu vývoje čipu. Samotné partnerství se datuje do října 2025, kdy OpenAI představila plány na vícegenerační vlastní akcelerační program po boku síťového giganta.

Podle OpenAI se Jalapeño liší od GPU pro všeobecné použití v tom, že byl navržen v souladu s modely, kterým bude sloužit. Vzhledem k tomu, že společnost ovládá celou sadu – produkty, modely, čipy a paměť AI – její inženýři byli schopni zaútočit na specifické fáze procesu odvození, které často způsobují tření.

Konkrétně je Jalapeño navrženo tak, aby minimalizovalo zpoždění během předvyplňování a komunikačních fází zpracování, které podle OpenAI často působí jako úzká hrdla při poskytování velkých jazykových modelů ve velkém měřítku.

„Navrhli jsme Jalapeño, abychom minimalizovali přesun dat a komunikační zpoždění,“ napsala společnost v blogovém příspěvku prezentujícím výsledky. "To znamená, že stav modelu, včetně mezipaměti KV použité při generování odpovědi, lze explicitně umístit a udržovat místní, zatímco systém aktivuje správnou kombinaci výpočtu, paměti a sítě pro každou fázi odvození."

Tento poslední bod je důležitý pro každého, kdo provozuje produkční úlohy AI. Mezipaměť KV – nashromážděný kontext, který model uchovává při generování odpovědi – je jedním z největších problémů s pamětí a šířkou pásma v moderním vyvozování. Klasickým způsobem, jak získat zpět latenci a výkon, je jeho udržování v místním a explicitně spravovaném stavu, spíše než jeho přehazování přes cluster.

Lepší než Blackwell — prozatím

Srovnání titulků je proti systému Nvidia Blackwell, který je v současnosti tahounem hraniční AI. Nezávislá analýza publikovaná ve stejný den SemiAnalysis s názvem „OpenAI Jalapeño: Lepší než Nvidia Blackwell“ dospěla k podobnému závěru o prvních výsledcích čipu a příběh se rychle stal jednou z nejvíce diskutovaných položek na Hacker News.

Ale vedoucí pracovníci a analytici OpenAI nabádají k opatrnosti. Ho odhadoval, že Jalapeño bude nasazeno na konci roku 2026 „ve velmi malých objemech“, přičemž významnější nasazení přijde v roce 2027. Než Jalapeño dosáhne plného rozsahu, může konkurence výrazně pokročit – plán Nvidie se stále posouvá a další hyperscalery včetně Google, Amazonu a Microsoftu prosazují svůj vlastní křemík.

Jak poznamenal TechCrunch, benchmarky měřené vůči dnešnímu stavu techniky jsou snímkem, nikoli zárukou. Čip, který v roce 2026 zvítězí na efektivitě, musí vyhrávat proti všemu, co Nvidia a její konkurenti dodají příští rok.

Proč si OpenAI buduje svůj vlastní křemík

Strategická logika je přímočará: inference je největší opakující se náklad OpenAI. Každý dotaz ChatGPT, každé volání API a každá úloha agenta spotřebovává výpočetní výkon a pronájem těchto výpočtů od společnosti Nvidia za tržní ceny zmenšuje marže podle měřítka využití. Vlastní čip vyladěný pro vlastní modely OpenAI – navržený společně s Broadcom a tvarovaný samotnými modely OpenAI – dává společnosti způsob, jak obsloužit více uživatelů za watt a dolar.

Jalapeño je také plánováno jako vícegenerační platforma spíše než jednorázová část. OpenAI uvedla, že má v úmyslu společně vyvíjet produkty, modely, čipy a paměti umělé inteligence, aby každá generace křemíku byla co-optimalizována s modely, které poběží. Pokud výsledky první generace vydrží ve výrobě, stane se Jalapeño šablonou pro vše, co bude následovat.

Sázky přesahují OpenAI. Dominance Nvidie v oblasti akcelerátorů AI byla už tři roky jediným nejtěsnějším hrdlem v oboru a každá důvěryhodná alternativa – ať už od týmu TPU od Googlu, Amazonu nebo nyní OpenAI – mění prostředí vyjednávání pro každého, kdo buduje infrastrukturu AI. Samotná Nvidia údajně varuje zákazníky před zvýšením cen o 15 procent nebo více na serverech s umělou inteligencí, protože náklady na paměť rostou, což jen posiluje přitažlivost interních alternativ.

Co přijde dál

Jalapeño zatím zůstává předprodukčním dílem se slibnými papírovými čísly. Skutečný test přijde na konci roku 2026, kdy budou nasazeny první malé objemy, a zejména v roce 2027, kdy OpenAI očekává smysluplné měřítko. Klíčové otázky zůstávají nezodpovězeny: spolehlivost v reálném světě v měřítku datových center, celkové náklady na vlastnictví oproti pronajaté kapacitě Blackwell a to, zda náskok v oblasti efektivity přežije proti nové generaci Nvidie.

Přesto první benchmarky znamenají milník: poprvé jedna z velkých laboratoří umělé inteligence veřejně demonstrovala vlastní inferenční křemík, který, jak se zdá, překonává ty nejlepší z hlediska účinnosti stávajícího operátora. Pro odvětví, které považovalo dodávky Nvidie za strategické záchranné lano, je to skutečný inflexní bod.

---

Stay Ahead of AI

Získejte nejnovější zprávy, analýzy a průlomové informace o umělé inteligenci – vše na jednom místě.

Přečtěte si další zprávy o AI →