Společnost Intel zahájila letošní konferenci Hot Chips hlubokým ponorem do Crescent Island, GPU datového centra, na které sází pro další fázi zátěže AI: agentní vyvozování. Přednáška, kterou představili hlavní architekt Enterprise AI Systems Sumit Mohan a člen Intel Hong Jiang, se soustředila na tři metriky, které společnost říká, že definují éru agentů – tokeny na watt, velká kapacita paměti a otevřený balík softwaru.
Na načasování záleží. Nvidia použila stejnou konferenci k podrobnostem o svém rackovém systému Vera Rubin NVL72 a každý prodejce akcelerátorů na Hot Chips 2026 nyní klade důraz na efektivitu spíše než na hrubý špičkový výkon. Odpovědí Intelu je část, která vyměňuje paměťovou technologii, kterou používají běžné AI GPU, za něco levnějšího za gigabajt, a to vede k pozoruhodným titulkům. For more context on this story, see our ongoing AI industry coverage.
480GB PCIe karta při 350 wattech
Crescent Island je 350wattový, vzduchem chlazený PCIe GPU. Značková karta Intel se dodává se 160 GB paměti LPDDR5X, ale design umožňuje partnerům ODM vytvářet varianty s až 480 GB na desce – což je zhruba trojnásobná kapacita typických akceleračních karet nejvyšší třídy a dostačující k tomu, aby byly rezidentní velmi velké KV-cache pro dlouhodobou a vícerelační agentní zátěž. Návrh pokrývá datové typy od FP4 a MXFP4 až po FP64.
Volba paměti je strategickým rozhodnutím v produktu. LPDDR5X vyměňuje šířku pásma za kapacitu a náklady, což odpovídá profilu pracovní zátěže odvození, kde obrovská kontextová okna a smyčky volání nástrojů spotřebovávají kapacitu paměti více než nezpracovaný výpočet. Intel zarámuje celý design kolem „tokenů na watt“ – přináší užitečnější výstup na jednotku energie, spíše než vyhrávat ve srovnání se špičkovými FLOPS.
Křemík Xe3P: 32 jader, 256 XMX motorů
Crescent Island je pod kapotou architektury Intel Xe3P a Intel ji prezentoval jako generační skok oproti generaci Xe2 založené na Battlemage. Tam, kde Xe2 nabízel 20 Xe jader a 4-hloubkové systolické pole XMX, Crescent Island přináší 32 Xe jader a 16-hluboké systolické pole, které napájí celkem 256 XMX motorů.
Třetí generace Xe Matrix Extensions přidává třícestný rozšířený maticový design Xe s precizním společným vydáním FP4 a podporou FP64. Každé jádro Xe nese soubor obecného registru o velikosti 1 MB a 512 KB mezipaměti L1 s 32 MB unifikované L2 sdílené napříč zařízením. Mediální engine se čtyřmi dekodéry a čtyřmi kodéry sedí vedle sebe a celý SoC se připojuje přes PCIe Gen5 x16 s podporou škálování přes otevřenou síť přepínačů. Intel uvádí aktivní klidový výkon 50 wattů nebo méně ve stavu G0 a zhruba 10 wattů ve stavu G8 s nízkou spotřebou, dosažený prostřednictvím distribuovaných energetických domén, paketových routerů network-on-chip s agresivním taktováním a nezávislých DVFS kolejnic pro grafiku a média.
Funkce RAS vypůjčené z příručky serveru
U části datového centra získalo inženýrství spolehlivosti stejně času jako propustnost – do tohoto tématu se Nvidia také opřela s Vera Rubin. Crescent Island přenáší ECC a paritu napříč klíčovými paměťovými strukturami, kontrolu chyb na každém skoku vnitřní propojovací struktury, dynamické odkládání stránek do režimu offline, tvrdé opravy po balení a pokročilé hlášení chyb PCI Express. Intel říká, že tato kombinace snižuje tiché poškození dat, což je režim selhání, který je pro dlouhotrvající bezobslužné vyvozování nejdůležitější.
Intel také umístil tuto část do portfolia, které sahá od GPU pracovních stanic Arc Pro až po získané RDU SambaNova SN50, s Crescent Island jako kotvou podnikového datového centra na vrcholu. Společnost ukázala linii cestovní mapy, která trvala více než šest let, a navrhla GPU jako vyspělý design třetí generace spíše než první pokus. Karta byla poprvé představena na Computexu v červnu; Hot Chips dodal architektonický detail za tím.
Proč Agentic Inference upřednostňuje tento design
Argument pracovní zátěže je nejzajímavější částí prezentace Intelu. Agentická AI – modely, které řetězí volání nástrojů, udržují otevřené dlouhé kontexty a koordinují CPU a GPU – zdaňuje latenci, kapacitu paměti a propustnost systému současně, spíše než profil dávkové propustnosti obsluhy chatbota. Kapacita mezipaměti KV pro dlouhé kontexty a souběžné relace v komprimované doméně je explicitně zabudována do návrhu SoC.
Toto zarámování také vysvětluje sázku LPDDR5X. Pokud jsou další vlnou AI computingu agenti nároční na paměť spíše než tréninkové běhy, 480GB karta při 350 wattech je věrohodnou alternativou k prémiovým dílům založeným na HBM – za předpokladu, že to softwarový balík poskytuje. Důraz Intelu na open stack a open switch fabric je zaměřen přímo na kupující, kteří se bojí integrovaného uzamčení platformy Nvidia.
Crescent Island nevytlačí tréninkové akcelerátory, které dominují titulkům AI, a Intel na konferenci nezveřejnil ceny ani dostupnost. Ale jako prohlášení o tom, kam si Intel myslí, že inference směřuje – tučná paměť, štíhlá síla, otevřená struktura – je to jeden z jasnějších příběhů o architektuře letošních Hot Chips.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →