Intel, bu yılki Hot Chips konferansını, AI iş yüklerinin bir sonraki aşaması olan aracı çıkarım için bahis oynadığı veri merkezi GPU'su Crescent Island'a derinlemesine bir bakışla açtı. Kurumsal Yapay Zeka Sistemleri Baş Mimarı Sumit Mohan ve Intel Üyesi Hong Jiang tarafından sunulan konuşma, şirketin aracılık çağını tanımladığını söylediği üç ölçüme odaklanıyordu: watt başına jeton, büyük bellek kapasitesi ve açık yazılım yığını.

Zamanlama önemlidir. Nvidia, Vera Rubin NVL72 raf ölçekli sistemini detaylandırmak için aynı konferansı kullandı ve Hot Chips 2026'daki her hızlandırıcı satıcısı artık ham performanstan ziyade verimliliği öne çıkarıyor. Intel'in cevabı, ana akım AI GPU'ların kullandığı bellek teknolojisini gigabayt başına daha ucuz bir şeyle değiştiren bir parçadır ve çarpıcı başlık sayılarına neden olur. For more context on this story, see our ongoing AI trends.

350 Watt'ta 480 GB PCIe Kart

Crescent Island, 350 watt'lık, hava soğutmalı bir PCIe GPU'dur. Intel markalı kart, 160 GB LPDDR5X bellekle birlikte gelir, ancak tasarım, ODM iş ortaklarının yerleşik 480 GB'a kadar varyantlar oluşturmasına olanak tanır; bu, tipik üst düzey hızlandırıcı kartların kapasitesinin kabaca üç katıdır ve uzun bağlam ve çok oturumlu ajansal iş yükleri için çok büyük KV önbelleklerini yerleşik tutmaya yeterlidir. Tasarım, FP4 ve MXFP4'ten FP64'e kadar veri türlerini kapsar.

Bellek seçimi üründeki stratejik karardır. LPDDR5X, bant genişliğini kapasite ve maliyet karşılığında değiştirir; bu da devasa bağlam pencerelerinin ve araç çağrısı döngülerinin ham bilgi işlemden daha fazla bellek kapasitesini tükettiği çıkarım iş yükü profiline uygundur. Intel, tüm tasarımı "watt başına jeton" etrafında çerçeveliyor; en yüksek FLOPS karşılaştırmalarını kazanmak yerine enerji birimi başına daha faydalı çıktı sağlıyor.

Xe3P Silicon: 32 Çekirdek, 256 XMX Motoru

Crescent Island, Intel'in Xe3P mimarisini içeriyor ve Intel bunu Battlemage tabanlı Xe2 nesline göre nesiller boyu bir sıçrama olarak sundu. Xe2, 20 Xe çekirdeği ve 4 derin sistolik XMX dizisi sunarken Crescent Island, toplamda 256 XMX motorunu besleyen 32 Xe çekirdeği ve 16 derin sistolik dizi getiriyor.

Üçüncü nesil Xe Matris Uzantıları, FP4 hassas ortak sorun ve FP64 desteğiyle üç yollu genişletilmiş Xe matris tasarımı ekler. Her Xe çekirdeği, 1 MB genel kayıt dosyası ve 512 KB L1 önbelleği taşır; 32 MB birleşik L2, cihaz genelinde paylaşılır. Dört kod çözücü ve dört kodlayıcıya sahip bir medya motoru yan yana duruyor ve tüm SoC, açık anahtar yapısında ölçek büyütme desteğiyle PCIe Gen5 x16 üzerinden bağlanıyor. Intel, G0 durumunda 50 watt veya daha az ve düşük güçlü G8 durumunda yaklaşık 10 watt'lık bir aktif boşta güç listeliyor; bu güç, dağıtılmış güç alanları, agresif saat geçişli paket tabanlı çip üzerinde ağ yönlendiricileri ve grafikler ve medya için bağımsız DVFS rayları aracılığıyla elde ediliyor.

Sunucunun Başucu Kitabından Ödünç Alınan RAS Özellikleri

Veri merkezi açısından güvenilirlik mühendisliği, üretim kadar hazırlık süresi de elde etti; Nvidia'nın Vera Rubin ile de ilgilendiği bir konu. Crescent Island, temel bellek yapılarında ECC ve eşlik, dahili ara bağlantı yapısının her noktasında hata kontrolü, dinamik sayfa çevrimdışına alma, paket sonrası sert onarım ve PCI Express Gelişmiş Hata Raporlama özelliklerini taşır. Intel, bu kombinasyonun, uzun süreli gözetimsiz çıkarım için en önemli hata modu olan sessiz veri bozulmasını azalttığını söylüyor.

Intel ayrıca bu parçayı, Arc Pro iş istasyonu GPU'larından edindiği SambaNova SN50 RDU'lara kadar uzanan bir portföy içinde konumlandırdı; Crescent Island, kurumsal veri merkezi dayanağı olarak en üstte yer aldı. Şirket, GPU'yu ilk denemeden ziyade olgun bir üçüncü nesil tasarım olarak ortaya koyan, altı yıldan uzun bir süreye uzanan bir yol haritası çizgisi gösterdi. Kart ilk olarak Haziran ayında Computex'te tanıtıldı; Hot Chips, arkasındaki mimari detayı ortaya koydu.

Neden Failsel Çıkarım Bu Tasarımı Tercih Ediyor?

İş yükü argümanı Intel'in sunumunun en ilginç kısmı. Aracı yapay zeka - araç çağrılarını zincirleyen, uzun bağlamları açık tutan ve CPU ile GPU arasında koordinasyon sağlayan modeller - sohbet robotu hizmetinin toplu iş hacmi profili yerine gecikmeyi, bellek kapasitesini ve sistem verimini aynı anda vergilendirir. Uzun bağlamlar ve sıkıştırılmış alan eş zamanlı oturumlar için KV önbellek kapasitesi, SoC tasarımına açıkça yerleştirilmiştir.

Bu çerçeve aynı zamanda LPDDR5X bahsini de açıklıyor. Yapay zeka hesaplamasının bir sonraki dalgası, eğitim çalıştırmaları yerine belleğe aç aracılar ise, 350 watt'lık 480 GB'lik bir kart, yazılım yığınının sunması koşuluyla, birinci sınıf HBM tabanlı parçalara güvenilir bir alternatiftir. Intel'in açık yığın ve açık anahtar yapısına verdiği önem, doğrudan Nvidia'nın entegre platform kilitlemesinden çekinen alıcıları hedef alıyor.

Crescent Island, AI manşetlerine hakim olan eğitim hızlandırıcılarının yerini almayacak ve Intel, konferansta fiyatlandırmayı veya bulunabilirliği açıklamadı. Ancak Intel'in çıkarımların nereye gittiğini düşündüğünün bir ifadesi olarak (yoğun bellek, yalın güç, açık yapı) bu yılki Hot Chips'in en net mimari hikayelerinden biri.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →