Intel mbukak konferensi Kripik Panas taun iki kanthi nyilem menyang Pulo Crescent, GPU pusat data sing dituju kanggo fase sabanjure beban kerja AI: inferensi agen. Disajikake dening Chief Enterprise AI Systems Architect Sumit Mohan lan Intel Fellow Hong Jiang, diskusi kasebut fokus ing telung metrik sing dikandhakake perusahaan kasebut nemtokake jaman agenik - token per watt, kapasitas memori gedhe, lan tumpukan piranti lunak sing mbukak.

Wektu iku penting. Nvidia nggunakake konferensi sing padha kanggo rinci babagan sistem skala rak Vera Rubin NVL72, lan saben vendor akselerator ing Hot Chips 2026 saiki luwih efisien tinimbang kinerja puncak mentah. Jawaban Intel minangka bagean sing ngganti teknologi memori mainstream AI GPU sing digunakake kanggo sing luwih murah saben gigabyte, lan nggawe nomer judhul sing apik banget. For more context on this story, see our ongoing AI news.

Kertu PCIe 480GB ing 350 Watts

Crescent Island punika 350-watt, udhara-cooled PCIe GPU. kertu branded Intel kapal karo 160GB saka memori LPDDR5X, nanging desain ngidini partners ODM kanggo mbangun varian karo munggah 480GB ing Papan - kira-kira telung kapasitas kertu akselerator dhuwur-mburi khas, lan cukup kanggo nyimpen KV-cache gedhe banget penduduk kanggo long-konteks lan multi-sesi workloads agen. Desain kalebu jinis data saka FP4 lan MXFP4 nganti FP64.

Pilihan memori minangka keputusan strategis ing produk. LPDDR5X dagang bandwidth kanggo kapasitas lan biaya, sing cocog karo profil beban kerja inferensi ing ngendi jendhela konteks gedhe lan puteran alat-panggilan nganggo kapasitas memori luwih saka komputasi mentah. Intel pigura kabeh desain watara "token saben watt" - ngirimke output luwih migunani saben unit energi tinimbang menang bandingaken puncak-FLOPS.

Xe3P Silicon: 32 Inti, 256 Mesin XMX

Ing ngisor tudung, Pulo Crescent minangka arsitektur Xe3P Intel, lan Intel nampilake minangka lompatan generasi liwat generasi Xe2 berbasis Battlemage. Ing ngendi Xe2 nawakake 20 intine Xe lan array XMX sistolik 4-jero, Pulo Crescent nggawa 32 intine Xe lan susunan sistolik 16-jero, kanthi total 256 mesin XMX.

Ekstensi Matriks Xe generasi katelu nambahake desain matriks Xe telung arah kanthi masalah bareng presisi FP4 lan dhukungan FP64. Saben inti Xe nggawa file registrasi umum 1MB lan cache L1 512KB, kanthi L2 gabungan 32MB sing dienggo bareng ing piranti kasebut. Mesin media karo papat dekoder lan papat encoder lenggah ing sandhinge, lan kabeh SoC nyambung liwat PCIe Gen5 x16 kanthi dhukungan kanggo skala ing kain switch sing mbukak. Intel nampilake daya nganggur aktif 50 watt utawa kurang ing negara G0 lan kira-kira 10 watt ing negara G8 kurang daya, ngrambah liwat domain daya mbagekke, paket basis jaringan-on-chip router karo gating jam agresif, lan ril DVFS sawijining kanggo grafis lan media.

Fitur RAS Dipinjam Saka Playbook Server

Kanggo bagean pusat data, rekayasa linuwih entuk akeh wektu panggung minangka throughput - tema Nvidia uga digandhengake karo Vera Rubin. Pulo Crescent nggawa ECC lan paritas ing struktur memori kunci, mriksa kesalahan ing saben hop saka kain interkoneksi internal, offline kaca dinamis, ndandani kirim-paket hard, lan Laporan Kesalahan Lanjut PCI Express. Intel ujar manawa kombinasi kasebut nyuda korupsi data bisu, mode kegagalan sing paling penting kanggo inferensi tanpa pengawasan sing dawa.

Intel uga nempatake bagean kasebut ing portofolio sing dawane saka GPU stasiun kerja Arc Pro liwat SambaNova SN50 RDU sing dipikolehi, kanthi Pulo Crescent minangka jangkar pusat data perusahaan ing sisih ndhuwur. Perusahaan kasebut nuduhake garis keturunan peta dalan sing mlaku luwih saka enem taun, nggawe GPU minangka desain generasi katelu sing diwasa tinimbang upaya pertama. Kertu kasebut pisanan dibukak ing Computex ing wulan Juni; Kripik Panas dikirim rincian arsitektur konco iku.

Napa Inferensi Agensi Seneng Desain Iki

Argumentasi beban kerja minangka bagean paling menarik saka pitch Intel. AI Agentik - model sing nelpon alat chain, mbukak konteks dawa, lan koordinasi antarane CPU lan GPU - latensi pajak, kapasitas memori, lan throughput sistem bebarengan, tinimbang profil batch-throughput saka chatbot porsi. Kapasitas cache KV kanggo konteks sing dawa lan sesi serentak domain sing dikompres dibangun ing desain SoC kanthi jelas.

Framing kasebut uga nerangake taruhan LPDDR5X. Yen gelombang komputasi AI sabanjure yaiku agen sing keluwen memori tinimbang latihan, kertu 480GB kanthi daya 350 watt minangka alternatif sing bisa dipercaya kanggo bagean basis HBM premium - kasedhiya tumpukan piranti lunak dikirim. Penekanan Intel ing tumpukan mbukak lan kain switch mbukak ditujukan kanggo para panuku sing waspada karo kunci platform terintegrasi Nvidia.

Pulo Crescent ora bakal ngganti akselerator latihan sing ndominasi berita utama AI, lan Intel ora ngumumake rega utawa kasedhiyan ing konferensi kasebut. Nanging minangka pratelan ing ngendi Intel mikir yen inferensi bakal ditindakake - memori lemak, kekuwatan ramping, kain mbukak - iki minangka salah sawijining crita arsitektur sing luwih jelas babagan Kripik Panas taun iki.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →