Cerebras, yeni WSE-3 Turbo levha ölçekli işlemcisi etrafında inşa edilen raf ölçekli bir yapay zeka çıkarım sistemi olan CS-4'ün üzerindeki örtüyü kaldırdı ve şirketin kendisini Nvidia'nın veri merkezi imparatorluğuna hız alternatifi olarak konumlandırmasıyla makinenin GPU tabanlı sistemlerden 30 kata kadar daha hızlı çıkarım sağladığını iddia etti.

Salı günü duyurulan ve şirketin ürün sayfaları ile Reuters, Bloomberg ve The Register'ın geniş kapsamlı haberlerinde ayrıntılarıyla açıklanan lansman, Cerebras'ın halka açıldığından bu yana en önemli donanım yenilemesine işaret ediyor ve halka arzından bu yana hisseleri zor durumda olan bir şirket için çok önemli bir an. Yatırımcılar dikkat ediyor gibi görünüyor: Cerebras'ın (CBRS) hisseleri bu haber üzerine yükselişe geçti ve Investor's Business Daily, CEO'nun yapay zeka çıkarım pazarının "çok hızlı büyüdüğü" yönündeki yorumunu aktardı.

Yapay zeka modellerinin daha hızlı yanıt vermesini sağlamak için hızlanan yarışı takip eden okuyucular için CS-4'ün lansmanı, çeyreğin en önemli donanım hikayelerinden biri ve bilgi işlem ortamını yeniden şekillendirmeye devam eden yapay zeka endüstrisi kapsamındaki daha geniş değişimlerin ortasında yer alıyor.

CS-4'ün İçinde Neler Var?

Ana bileşen, Cerebras'ın yemek tabağı boyutundaki Gofret Ölçekli Motorunun yükseltilmiş bir versiyonu olan WSE-3 Turbo'dur. The Register'ın ayrıntılı teknik incelemesine göre WSE-3T yeni silikon değil; iki yıllık WSE-3 ile aynı TSMC 5nm sürecini, 46.225 milimetrekare kalıp alanını, 4 trilyon transistörü, 900.000 çekirdeği ve 44 GB plaka üzeri SRAM'ı koruyor.

Bunun yerine Cerebras, mevcut çipi çok daha fazla zorlayarak performansı iki katına çıkarmayı başardı. WSE-3T, seyrek FP16 hesaplamasını ikiye katlayarak 250 petaFLOPS'a çıkarır, yoğun FP16 performansını ikiye katlayarak tahmini 25 petaFLOPS'a çıkarır, bellek bant genişliğini ikiye katlayarak saniyede 43,2 petabayta ve G/Ç bant genişliğini ikiye katlayarak saniyede 2,4 terabit'e çıkarır. Register, şirketin artık silikonu önceki nesilde yaklaşık 1,4 GHz'den kabaca 2,8 GHz'e çıkardığını tahmin ediyor.

Cerebras'a göre işin püf noktası, işlemciden yalnızca 0,5 milimetre uzakta bulunan, yeniden tasarlanmış bir güç dağıtım sistemidir; bu, geleneksel GPU kartlarındaki ~50 milimetreden yaklaşık 100 kat daha yakındır. Bu yakınlık, kart seviyesindeki güç kaybını neredeyse ortadan kaldırır ve levhaya iki kat daha fazla gücün ulaşmasını sağlayarak, daha hızlı token üretiminin arkasında daha yüksek çalışma frekanslarının oluşmasını sağlar.

Nexus Raf Mimarisi

Çipin ötesinde CS-4, Cerebras'ın Nexus Platform Mimarisi adını verdiği, ilk gerçek raf ölçekli tasarımı ve Nvidia'nın NVL72 ve AMD'nin Helios raf sistemlerine doğrudan yanıt olan şeyi sunuyor. Her bir CS-4, bağımsız "Gofret Ölçeği Sırt Çantalarında" bulunan üç adede kadar WSE-3T işlemciyi taşıyabilir; bu, levhayı, güç dönüşümünü, doğrudan sıvı soğutmayı, yüksek hızlı G/Ç'yi ve kontrol elektroniklerini %50 daha az bileşenle tek bir düzenekte katlayan 3 boyutlu paketlerdir.

Modüler tasarım, kararlı güç, soğutma ve ağ katmanını bilgi işlemden ayırır. Şirkete göre Cerebras PowerRack, herhangi bir bilgi işlem gelmeden önce kurulabilir ve tesis için uygun hale getirilebilir ve sırt çantaları daha sonra yerine kaydırılarak dağıtım süresini günlerden saatlere indirir.

Güç tüketimi önemli düzeydedir. Register, sırt çantası başına yaklaşık 46 kW ve toplam sistem çekişinin 120 ila 140 kW olduğunu tahmin ediyor; AMD ve Nvidia'nın bu yılın sonlarında piyasaya sürmesi beklenen 240 ila 250 kW raf sistemlerinin yanında yine de muhafazakar görünen göz alıcı rakamlar.

Anahtarı Kapatmak

Belki de teknik açıdan en ilginç seçim ara bağlantıdır. AWS'nin Trainium3 hızlandırıcıları için benimsediği yaklaşımla plakadan plakaya trafiği anahtarlar üzerinden yönlendirmek yerine Cerebras, çiplerini komşu plakaların birbirleriyle doğrudan konuştuğu 2 boyutlu torus topolojisine bağlar. Tasarım, levhadan levhaya gecikmeyi beş mikrosaniyeden yalnızca ikiye indiriyor ve Cerebras, ağın 50 trilyona kadar parametreye sahip modelleri, şu anda var olan her şeyin ötesinde rahatlıkla destekleyebileceğini söylüyor.

Hız sonuçları çarpıcı. Kıyaslama firması Yapay Analiz, tek bir CS-4 sisteminde, gpt-oss-120b'de kullanıcı başına saniyede 4.400 jetona kadar ölçüm yaptı; bu, günümüzde mevcut olan en hızlı GPU tabanlı çıkarım hizmetlerinin kabaca saniyede ~350 jetonunun 12 katıdır. Cerebras ayrıca sistemin 10 trilyon parametreyi aşan modellerde saniyede 1.000'den fazla tokeni desteklediğini iddia ediyor.

Ayrıştırılmış Bir Ortaklık Stratejisi

Cerebras'ın artık tüm çıkarım hattını kendi silikonu üzerinden yürütmeye çalışmaması dikkat çekicidir. Şirket, çıkarımın bilgi işlem yoğun hızlı işlem aşamasını sırasıyla Trainium XPU'lara ve Instinct GPU'lara boşaltmak için AWS ve AMD ile ortaklık kurdu ve yonga levha ölçekli motorlarının devasa SRAM rezervlerinin parladığı gecikmeye duyarlı kod çözme aşamasını yönetmesine izin verdi.

CS-4 lansmanı aynı zamanda Cerebras'ın OpenAI ile olan işbirliğini de genişletiyor. Yahoo Finance, yapay zeka çıkarımını hızlandırmayı amaçlayan yeni OpenAI ve AMD ortaklıklarının yanı sıra bu açılışı bildirdi; bu, şirketlerin Ağustos ayının başında tanıttığı ve kullanıcılara saniyede 750 tokene kadar GPT-5.6 Sol getiren Ultrafast modunu temel alıyor.

Başlık Numaralarının Arkasındaki Uyarılar

Sektör analistleri pazarlama rakamlarına biraz dikkat edilmesi çağrısında bulunuyor. Register, Cerebras'ın 250 petaFLOPS başlığının, genellikle büyük dil modeli çıkarımına fayda sağlamayan seyrekliğe dayandığını ve WSE-3'ün kendi SRAM'ını doyuracak hesaplamaya sahip olmaması nedeniyle en yüksek bellek bant genişliği rakamlarının büyük ölçüde teorik olduğunu belirtiyor. Yayın ayrıca Cerebras'ın, WSE-2'nin beş yıl önce piyasaya sürülmesinden bu yana anlamlı bir şekilde artmayan SRAM kapasitesini artırmak yerine neden performansı iki katına çıkardığını sorguladı; kod çözme hızlandırıcılarının bellekten en fazla yararlandığı ayrıştırılmış çıkarım çağında ilginç bir seçim.

Yine de pazar fırsatı gerçektir. Yapay zeka sohbet robotları ve aracıları her zamankinden daha hızlı tepki süreleri talep ettikçe, çıkarım hızı rekabette gerçek bir fark yaratan unsur haline geldi ve Cerebras artık geleneksel olmayan plaka ölçeği teknolojisini ticari bir tempoda yineleyebileceğini gösterdi.

İlk CS-4 sevkiyatları bu çeyrekte başlayacak ve ilk sistemlerin Eylül ayının sonundan önce çevrimiçi olması bekleniyor. Bunun Nvidia'nın hakimiyetini çökertmeye yetip yetmeyeceğini zaman gösterecek ancak uzun zamandır ilk kez sektördeki en hızlı yapay zeka çıkarımının yeni bir adresi var.

Yapay Zekanın Önünde Olun

CS-4 gibi donanım lansmanları piyasaları harekete geçiriyor ve yapay zeka sistemlerinin neler yapabileceğini yeniden tanımlıyor. Her gelişmeyi takip etmek için Daha fazla AI haberini okuyun.

En son AI kapsamını keşfedin →