AMD ve Cerebras Systems, AMD'nin raf ölçekli Helios platformunu Cerebras'ın Wafer-Scale Engine (WSE) ile tek, ayrıştırılmış bir iş akışında birleştirerek yeni türde bir yapay zeka çıkarım altyapısı oluşturmak için teknik bir ortaklığı duyurdu. AMD'nin 23 Temmuz 2026'daki Advancing AI 2026 etkinliğinde duyurulan işbirliği, çıkarımı üretken yapay zeka çağındaki en pahalı sorunlardan biri haline getiren gecikme ve üretim darboğazlarını doğrudan hedef alıyor. Sektörün hızla gelişen bu köşesine ilişkin en son haberler için son dakika yapay zeka haberlerini haberimizi takip edin.
Temel fikir, bir çipi her şeyi yapmaya zorlamayı bırakmaktır. Geleneksel bir çıkarım yığınında, tek bir GPU ailesi, hem bir istemin sindirilmesine yönelik ağır ön doldurma işini hem de her yeni jetonun oluşturulmasına ilişkin hassas, sıralı çalışmayı üstlenir. Bu bir uzlaşmadır çünkü iki işin talepleri çok farklı. AMD ve Cerebras, ayrıştırılmış çıkarım olarak bilinen bir teknik olan işi bölmenin, her motorun en iyi yaptığı şeyi yapmasına olanak sağladığını savunuyor.
İki motor işi nasıl bölüşüyor?
AMD'nin resmi duyurusuna göre AMD Helios, büyük miktardaki girdileri hızla işlemek için AMD Instinct GPU'lardan yararlanarak yüksek performanslı, ölçeklenebilir bir üretim motoru olarak hizmet verecek. Bu arada Cerebras Wafer-Scale Engine, ultra hızlı, ultra düşük gecikmeli kod çözme ve jeton oluşturma işlemlerini gerçekleştirecek. Cerebras'ın çipleri, tek tek kalıplara bölünmek yerine tüm levhalar üzerine inşa edilmiştir; bu da onlara, tokenlerin durmadan yayınlanması için özellikle çok uygun olan muazzam çip üzeri bellek bant genişliği sağlar.
Şirketler, iki bilgi işlem motorunu birleştirerek, ortak çözümün watt başına saniyede 5 kata kadar daha yüksek token sunmasının beklendiğini söylüyor; bu, sağlayıcılar hem hız hem de enerji maliyetleri konusunda rekabet ederken çıkarım ekonomisi için merkezi bir puan kartı haline gelen bir ölçüm. Bu rakam AMD'nin basın bülteninde belirtildi ve Tom's Hardware, Investing.com ve Yahoo Tech gibi kuruluşlarda rapor edildi.
Nvidia'nın hakimiyetine bir darbe
Ortaklık aynı zamanda stratejik bir sinyaldir. Nvidia'nın CUDA ekosistemi ve GPU serisi şu anda yapay zeka eğitimi ve çıkarımına hakim durumda ve rakipler, tek bir mimaride yerleşik firmayı yenmenin giderek zor olduğu sonucuna varıyor. Business Insider anlaşmayı, AMD'nin, modeller geliştirme aşamasından üretim aşamasına geçtikçe yapay zeka hesaplama aşamasının en hızlı şekilde büyümesi beklenen çıkarım üzerine bahis oynayarak Nvidia'ya karşı bir hamle yapması olarak çerçeveledi.
AMD için Cerebras ile eşleşme, Instinct ve Helios yol haritasının çekiciliğini eğitimin ötesine taşıyor. Nasdaq'da AMD'nin (NASDAQ: AMD) yanı sıra CBRS kodu altında işlem gören Cerebras için, büyük bir hızlandırıcı tedarikçisiyle entegrasyon, yonga levha ölçeğindeki teknolojisine büyük kurumsal ve bulut dağıtımlarına yönelik daha net bir yol sağlıyor. Cerebras, AMD Helios'u kendi veri merkezlerinde kurmayı planlıyor ve şirketler ortak çözümün ilk olarak 2026'nın ikinci yarısında Cerebras Cloud aracılığıyla kullanıma sunulmasını bekliyor.
Ayrıştırma neden şimdi önemli?
Çıkarım maliyetleri yapay zeka endüstrisi için belirleyici bir baskı noktası haline geldi. Modeller büyüdükçe ve uygulamalar gerçek zamanlı yanıtlar talep ettikçe, her bir token oluşturma maliyeti ve kullanıcıların bunu beklerken yaşadığı gecikme, bir ürünün uygun olup olmadığını belirleyebilir. Ayrıştırılmış çıkarım, önceden doldurma ve kod çözmeyi, her biri için en iyi eşleşen donanıma yönlendirilebilecek ayrı iş yükleri olarak ele alır; bu, Cerebras gibi şirketlerin bir yılı aşkın süredir savunduğu bir tasarım felsefesidir.
AMD-Cerebras'ın duyurusu, yaklaşımın isyankar bir fikirden endüstri tarafından onaylanmış bir mimariye doğru ilerlediğini gösteriyor. Bir üretim uzmanını bir gecikme uzmanıyla eşleştiren iki şirket, çıkarımın geleceğinin hepsine hükmedecek tek bir çip değil, özel motorlardan oluşan koordineli bir sistem olacağı konusunda iddiaya giriyor.
Ne izlemeli
Geriye birkaç soru kalıyor. Watt başına saniyede 5 token rakamı, üçüncü taraf bir kıyaslama yerine bir beklentidir ve gerçek dünya performansı, müşterilerin çalıştırdığı belirli modellere ve iş yüklerine bağlı olacaktır. Cerebras Bulut lansmanının ötesindeki fiyatlandırma ve kullanılabilirlik ayrıntıları açıklanmadı ve çözümün diğer bulut sağlayıcılarına ne zaman ulaşacağı da belirsiz.
Yine de anlaşma, yapay zeka donanımında daha geniş bir değişimin altını çiziyor: Tek bir GPU mimarisinin yapay zeka hattının her aşamasına hizmet edeceği varsayımı geçerliliğini yitiriyor. AMD ve Cerebras verimlilik iddialarını karşılayabilirse, ayrıştırılmış çıkarım, en büyük yapay zeka sistemlerinin oluşturulmasının standart bir parçası haline gelebilir.
Yapay Zekanın Önünde Kalın
Yapay zeka donanım ortamı uzmanlaşmış kamplara ayrılıyor ve bunun maliyet, hız ve rekabet üzerindeki etkileri çok büyük. Tüm önemli anlaşmaları, yayınları ve karşılaştırmaları takip etmek için AI Buzz Wire'da Daha fazla AI haberini okuyun.


