Cerebras Systems ve OpenAI, ilk olarak OpenAI API'de başlatılan ve Cerebra'nın levha ölçeği teknolojisiyle desteklenen yeni bir hizmet katmanı olan Ultrafast Mode'a ilk bakışı paylaştı. Ortaklık, GPT-5.6 Sol'un saniyede 750'ye kadar çıkış tokeni hızında çalışmasını sağlayarak gerçek zamanlı hızlarda sınır düzeyinde zeka sunmasını sağlıyor. En son AI donanım haberleri için AI Buzz Wire adresini ziyaret edin.
Hız-Zeka Dengesini Ortadan Kaldırmak
Yapay zeka geliştiricileri uzun süredir temel bir ödünleşimle karşı karşıya: Modellerin boyutu ve zekası büyüdükçe, daha yüksek hesaplama ve veri taşıma maliyetlerine neden oluyor, bu da yanıt sürelerini yavaşlatıyor. Geliştiriciler, yüksek kaliteli sonuçları beklemek veya daha kısa sürede daha düşük sonuçları kabul etmek arasında seçim yapmak zorunda kaldı.
Ultra Hızlı Modda GPT-5.6 Sol bu ikilemi çözmek için tasarlanmıştır. Cerebras'a göre hizmet, Yapay Analiz tarafından bildirilen çıktı hızlarına göre Anthropic'in Claude Fable 5'inden 11 kat, Hızlı modda Opus 4.8'den 5 kat daha hızlı çalışıyor.
İnsanlığın Son Sınavı: Hız Testi
Cerebras, Ultrafast'ı, genellikle yalnızca kimya, ekonomi ve edebiyat gibi alanlarda doktora sahibi kişilerin yanıtlayabildiği 2.500 sorudan oluşan zorlu bir kıyaslama olan İnsanlığın Son Sınavında (HLE) rakip modellere karşı teste tabi tuttu.
Cerebras tarafından yapılan değerlendirmelerde Ultra Hızlı Modda GPT-5.6 Sol, 2.500 HLE sorusunun tamamını 11 saat 11 dakikada yanıtladı. Claude Fable 5'te aynı sonuçlara varmak için 78 saat 27 dakika, yani üç günden fazla sürekli hesaplama gerekti. Başka bir deyişle Ultrafast, insan bilgisinin sınırlarını tek bir iş gününde işleyerek neredeyse yedi kat daha hızlı karşılaştırılabilir bir doğruluk elde etti.
Karşılaştırma, 10 Temmuz'da yüksek muhakeme ayarlarında Codex ile GPT-5.6 Sol Ultrafast ve 13-15 Temmuz tarihleri arasında yüksek muhakeme ayarlarında Claude Code ile Claude Fable 5 kullanılarak Cerebras tarafından gerçekleştirildi.
Gerçek Dünya İş Etkisi
Ekonomik açıdan değerli bilgi çalışması görevleri için bir referans noktası olan GDP-Val'de Ultrafast, hiçbir kalite kaybı olmaksızın 5,6 kat uçtan uca hızlanma sağladı. Bu, çıktı kalitesinden ödün vermeden, daha hızlı çıkarımların ekonomik açıdan değerli işleri nasıl hızlandırabileceğini göstermektedir.
Cerebras, Ultrafast'i her saniyenin önemli olduğu senaryolar için bir araç olarak görüyor. Web hizmetleri işleten şirketler, üretim kesintilerinin temel nedenini bulmak ve daha hızlı çözüm bulmak için teknolojiyi kullanabilir, böylece müşteri güvenini koruyabilir ve gelir kaybını önleyebilirler. Yüksek riskli siber güvenlik durumlarında, güvenlik ekipleri saldırıları hızlı bir şekilde tespit etmek ve bunlara yanıt vermek için Ultrafast'ten yararlanabilir.
Hızın Arkasındaki Teknoloji
Performans avantajı, Cerebras'ın ileri düzey yapay zeka iş yükleri için özel olarak tasarlanmış Wafer-Scale Engine mimarisinden kaynaklanıyor. Hızlı sınır çıkarımının temel zorluğu bir veri hareketi sorunudur: geleneksel GPU'larda, büyük modellerdeki çıkarımlar bellek bant genişliği nedeniyle darboğazlanır, çünkü model ağırlıklarının ardışık belirteçler oluşturmak için çip üzerindeki bellek ile çip dışı depolama arasında tekrar tekrar aktarılması gerekir.
Cerebras temelde farklı bir yaklaşım benimsiyor. Her bir levha boyutundaki çip, doğrudan silikon üzerinde 44 GB SRAM barındırıyor. Model ağırlıkları çip üzerinde kalır ve jetonlar, levhalar boyunca boru hattına yerleştirilmiş model katmanları boyunca kesintisiz olarak akar. Bu, GPU tabanlı çıkarımı yavaşlatan ve model boyutuna göre sorunsuz bir şekilde ölçeklenen verimsiz veri hareketini ortadan kaldırarak gelecekteki öncü modellerde sürekli hız avantajının önünü açıyor.
Kullanılabilirlik ve Pazar Konumlandırması
Ultra Hızlı Modda GPT-5.6 Sol şu anda sınırlı bir önizlemeyle belirli bir müşteri grubuna sunulmaktadır ve kapasite arttıkça erişim zaman içinde genişler. Cerebras, ortaklığın bir sonraki yapay zeka inovasyon dalgasına güç vermek ve kuruluşların duyarlı yapay zeka ile başarabilecekleri tavanı yükseltmek olarak tanımlıyor.
İşbirliği, GPU'nun hakim olduğu yapay zeka donanım pazarına alternatif olarak uzun süredir yonga levha ölçeğinde hesaplama peşinde koşan Cerebras için önemli bir kilometre taşını temsil ediyor. Mevcut en yetenekli sınır modellerinden birini hızlandırmak için OpenAI ile doğrudan ortaklık kuran Cerebras, mimarisinin yüksek hızlı çıkarım iş yükleri için gerçek bir rekabet avantajı sunduğunu güçlü bir şekilde ortaya koyuyor.
Modeller büyümeye ve daha akıllı olmaya devam ettikçe, onlara gerçek zamanlı hızlarda hizmet verme yeteneği, yapay zeka altyapı pazarında belirleyici bir rekabet faktörü haline gelebilir. Cerebras-OpenAI ortaklığı, çıkarım hızı yarışının artık model zekası yarışı kadar önemli olduğunun sinyalini veriyor.
Yapay Zekanın Önünde Kalın
Daha fazla AI donanım haberi, model performansı analizi ve sektördeki gelişmeler için AI Buzz Wire yer işaretine ekleyin.
Daha fazla AI haberini okuyun →