Intel opende de Hot Chips-conferentie van dit jaar met een diepe duik in Crescent Island, de datacenter-GPU waarop het gokt voor de volgende fase van AI-workloads: agentische inferentie. De lezing, gepresenteerd door Chief Enterprise AI Systems Architect Sumit Mohan en Intel Fellow Hong Jiang, concentreerde zich op drie maatstaven die volgens het bedrijf het agentische tijdperk definiëren: tokens per watt, grote geheugencapaciteit en een open softwarestack.

De timing is belangrijk. Nvidia gebruikte dezelfde conferentie om zijn Vera Rubin NVL72 rack-scale-systeem te detailleren, en elke accelerator-leverancier op Hot Chips 2026 gooit nu efficiëntie in plaats van pure topprestaties. Het antwoord van Intel is een onderdeel dat de geheugentechnologie die reguliere AI GPU's gebruiken, verruilt voor iets goedkopers per gigabyte, en het zorgt voor opvallende krantenkoppen. Voor meer context over dit verhaal, zie ons AI-trends.

Een PCIe-kaart van 480 GB bij 350 watt

Crescent Island is een luchtgekoelde PCIe GPU van 350 watt. Intel's merkkaart wordt geleverd met 160 GB LPDDR5X-geheugen, maar het ontwerp stelt ODM-partners in staat varianten te bouwen met maximaal 480 GB aan boord - grofweg driemaal de capaciteit van typische high-end acceleratorkaarten, en genoeg om zeer grote KV-caches beschikbaar te houden voor agentische werklasten met lange context en meerdere sessies. Het ontwerp omvat gegevenstypen van FP4 en MXFP4 tot en met FP64.

De geheugenkeuze is de strategische beslissing in het product. LPDDR5X ruilt bandbreedte in voor capaciteit en kosten, wat past bij een werklastprofiel waarbij enorme contextvensters en tool-call-loops meer geheugencapaciteit verbruiken dan onbewerkte rekenkracht. Intel kadert het hele ontwerp rond "tokens per watt" - waardoor een meer bruikbare output per eenheid energie wordt geleverd in plaats van piek-FLOPS-vergelijkingen te winnen.

Xe3P Silicon: 32 kernen, 256 XMX-motoren

Onder de motorkap is Crescent Island de Xe3P-architectuur van Intel, en Intel presenteerde het als een generatiesprong ten opzichte van de op Battlemage gebaseerde Xe2-generatie. Waar Xe2 20 Xe-kernen en een 4-diepe systolische XMX-array aanbood, brengt Crescent Island 32 Xe-kernen en een 16-diepe systolische array, die in totaal 256 XMX-motoren voeden.

De Xe Matrix Extensions van de derde generatie voegen een drievoudig uitgebreid Xe-matrixontwerp toe met FP4-precisie co-uitgave en FP64-ondersteuning. Elke Xe-core bevat een algemeen registerbestand van 1 MB en 512 KB L1-cache, met een verenigde L2 van 32 MB die over het hele apparaat wordt gedeeld. Ernaast zit een media-engine met vier decoders en vier encoders, en de hele SoC is verbonden via PCIe Gen5 x16 met ondersteuning voor opschaling via een open switch-structuur. Intel vermeldt een actief inactief vermogen van 50 watt of minder in de G0-status en ongeveer 10 watt in de laagvermogen-G8-status, bereikt door gedistribueerde stroomdomeinen, pakketgebaseerde netwerk-op-chip-routers met agressieve klokgating en onafhankelijke DVFS-rails voor grafische afbeeldingen en media.

RAS-functies geleend van het serverplaybook

Voor een datacenteronderdeel kreeg betrouwbaarheidsengineering evenveel podiumtijd als doorvoer - een thema waar Nvidia zich ook samen met Vera Rubin op richtte. Crescent Island voert ECC en pariteit uit over belangrijke geheugenstructuren, foutcontrole op elke hop van de interne interconnect-structuur, dynamische pagina-offlining, harde reparatie na het pakket en PCI Express Advanced Error Reporting. Intel zegt dat de combinatie stille gegevenscorruptie vermindert, de foutmodus die het belangrijkst is voor langlopende onbeheerde gevolgtrekkingen.

Intel positioneerde het onderdeel ook binnen een portfolio dat zich uitstrekt van Arc Pro-werkstation-GPU's tot de SambaNova SN50 RDU's die het heeft overgenomen, met Crescent Island als het anker voor het zakelijke datacenter bovenaan. Het bedrijf toonde een routekaart die meer dan zes jaar teruggaat, waarbij de GPU werd voorgesteld als een volwassen ontwerp van de derde generatie in plaats van als een eerste poging. De kaart werd voor het eerst onthuld op Computex in juni; Hot Chips leverde het architectonische detail erachter.

Waarom Agentic Inference de voorkeur geeft aan dit ontwerp

Het werklastargument is het meest interessante deel van Intel's pitch. Agentische AI ​​- modellen die toolaanroepen aan elkaar koppelen, lange contexten openhouden en coördineren tussen CPU en GPU - belasten tegelijkertijd de latentie, de geheugencapaciteit en de systeemdoorvoer, in plaats van het batch-doorvoerprofiel van chatbotdiensten. KV-cachecapaciteit voor lange contexten en gelijktijdige sessies met gecomprimeerde domeinen is expliciet ingebouwd in het SoC-ontwerp.

Die framing verklaart ook de LPDDR5X-weddenschap. Als de volgende golf van AI-computing bestaat uit geheugenvretende agents in plaats van trainingsruns, is een kaart van 480 GB bij 350 watt een geloofwaardig alternatief voor premium op HBM gebaseerde onderdelen - op voorwaarde dat de softwarestack dit levert. Intel's nadruk op een open stack en open switch-structuur is regelrecht gericht op kopers die op hun hoede zijn voor Nvidia's geïntegreerde platformlock-in.

Crescent Island zal de trainingsversnellers die het AI-nieuws domineren niet verdringen, en Intel heeft op de conferentie geen prijzen of beschikbaarheid bekendgemaakt. Maar als verklaring van waar Intel denkt dat de inferentie naartoe gaat - dik geheugen, lean power, open fabric - is het een van de duidelijkere architectuurverhalen van de Hot Chips van dit jaar.

---

Blijf Voorop met AI

Het laatste AI-nieuws, analyses en doorbraken — allemaal op één plek.

Lees meer AI-nieuws →