Intel membuka persidangan Hot Chips tahun ini dengan menyelam lebih dalam ke Pulau Crescent, GPU pusat data yang dipertaruhkan untuk fasa seterusnya beban kerja AI: inferens agen. Dibentangkan oleh Ketua Arkitek Sistem AI Perusahaan Sumit Mohan dan Fellow Intel Hong Jiang, ceramah itu tertumpu pada tiga metrik yang dikatakan syarikat mentakrifkan era agen - token per watt, kapasiti memori yang besar dan timbunan perisian terbuka.

Masa penting. Nvidia menggunakan persidangan yang sama untuk memperincikan sistem skala rak Vera Rubin NVL72, dan setiap vendor pemecut di Hot Chips 2026 kini menunjukkan kecekapan berbanding prestasi puncak mentah. Jawapan Intel ialah bahagian yang menukar teknologi memori arus perdana AI GPU yang digunakan untuk sesuatu yang lebih murah setiap gigabait, dan ia menghasilkan nombor tajuk yang menarik. For more context on this story, see our ongoing latest AI developments.

Kad PCIe 480GB pada 350 Watt

Crescent Island ialah GPU PCIe 350-watt, penyejuk udara. Kad berjenama Intel dihantar dengan 160GB memori LPDDR5X, tetapi reka bentuk membolehkan rakan kongsi ODM membina varian dengan sehingga 480GB di atas kapal - kira-kira tiga kali ganda kapasiti kad pemecut tipikal mewah, dan cukup untuk menyimpan cache KV yang sangat besar untuk beban kerja agenik konteks panjang dan berbilang sesi. Reka bentuk merangkumi jenis data daripada FP4 dan MXFP4 sehingga FP64.

Pilihan ingatan adalah keputusan strategik dalam produk. LPDDR5X memperdagangkan lebar jalur untuk kapasiti dan kos, yang sesuai dengan profil beban kerja inferens di mana tetingkap konteks yang besar dan gelung panggilan alat menggunakan kapasiti memori lebih daripada pengiraan mentah. Intel membingkai keseluruhan reka bentuk di sekitar "token per watt" - memberikan output yang lebih berguna bagi setiap unit tenaga daripada memenangi perbandingan FLOPS puncak.

Silikon Xe3P: 32 Teras, 256 Enjin XMX

Di bawah hud, Crescent Island ialah seni bina Intel Xe3P, dan Intel mempersembahkannya sebagai lompatan generasi ke atas generasi Xe2 berasaskan Battlemage. Di mana Xe2 menawarkan 20 teras Xe dan tatasusunan XMX sistolik 4-dalam, Crescent Island membawakan 32 teras Xe dan tatasusunan sistolik 16-dalam, memberi makan kepada 256 enjin XMX secara keseluruhan.

Sambungan Matriks Xe generasi ketiga menambah reka bentuk matriks Xe lanjutan tiga hala dengan keluaran bersama ketepatan FP4 dan sokongan FP64. Setiap teras Xe membawa fail daftar umum 1MB dan 512KB cache L1, dengan L2 bersatu 32MB dikongsi merentas peranti. Enjin media dengan empat penyahkod dan empat pengekod terletak bersebelahan, dan keseluruhan SoC bersambung melalui PCIe Gen5 x16 dengan sokongan untuk penskalaan merentas fabrik suis terbuka. Intel menyenaraikan kuasa melahu aktif sebanyak 50 watt atau kurang dalam keadaan G0 dan kira-kira 10 watt dalam keadaan G8 berkuasa rendah, yang dicapai melalui domain kuasa teragih, penghala rangkaian pada cip berasaskan paket dengan gating jam yang agresif, dan rel DVFS bebas untuk grafik dan media.

Ciri RAS Dipinjam Daripada Buku Main Pelayan

Untuk bahagian pusat data, kejuruteraan kebolehpercayaan mendapat masa peringkat sebanyak daya pemprosesan - tema yang turut digunakan oleh Nvidia dengan Vera Rubin. Crescent Island membawa ECC dan pariti merentasi struktur memori utama, semakan ralat pada setiap lompatan fabrik interkoneksi dalaman, luar talian halaman dinamik, pembaikan pasca pakej yang keras dan Pelaporan Ralat Lanjutan PCI Express. Intel berkata gabungan itu mengurangkan rasuah data senyap, mod kegagalan yang paling penting untuk inferens tanpa pengawasan yang berjalan lama.

Intel juga meletakkan bahagian dalam portfolio yang terbentang daripada GPU stesen kerja Arc Pro melalui SambaNova SN50 RDU yang diperolehnya, dengan Crescent Island sebagai penambat pusat data perusahaan di bahagian atas. Syarikat itu menunjukkan garis keturunan peta jalan yang berjalan lebih dari enam tahun, menjadikan GPU sebagai reka bentuk generasi ketiga yang matang dan bukannya percubaan pertama. Kad itu mula diperkenalkan di Computex pada bulan Jun; Hot Chips menyampaikan butiran seni bina di belakangnya.

Mengapa Inferens Agensi Mengutamakan Reka Bentuk Ini

Hujah beban kerja adalah bahagian paling menarik dari padang Intel. AI Agentik - model yang merangkaikan panggilan alat, membuka konteks panjang dan menyelaras antara CPU dan GPU - mengenakan cukai kependaman, kapasiti memori dan daya pemprosesan sistem secara serentak, dan bukannya profil pemprosesan kelompok bagi penyajian chatbot. Kapasiti cache KV untuk konteks yang panjang dan sesi serentak domain mampat dibina ke dalam reka bentuk SoC secara eksplisit.

Pembingkaian itu juga menerangkan pertaruhan LPDDR5X. Jika gelombang pengiraan AI seterusnya adalah ejen yang mementingkan memori dan bukannya latihan, kad 480GB pada 350 watt ialah alternatif yang boleh dipercayai kepada bahagian berasaskan HBM premium - dengan syarat susunan perisian dihantar. Penekanan Intel pada tindanan terbuka dan fabrik suis terbuka ditujukan tepat kepada pembeli yang berhati-hati terhadap penguncian platform bersepadu Nvidia.

Pulau Crescent tidak akan menggantikan pemecut latihan yang mendominasi tajuk utama AI, dan Intel tidak mendedahkan harga atau ketersediaan pada persidangan itu. Tetapi sebagai kenyataan tentang ke mana Intel berpendapat inferens akan berlaku - memori gemuk, kuasa kurus, fabrik terbuka - ia adalah salah satu cerita seni bina yang lebih jelas mengenai Hot Chips tahun ini.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →