Cerebras wis ngrampungake CS-4, sistem inferensi AI skala rak sing dibangun ing sekitar prosesor skala wafer WSE-3 Turbo sing anyar, ngaku mesin kasebut menehi inferensi kaping 30 luwih cepet tinimbang sistem basis GPU amarga perusahaan kasebut minangka alternatif kacepetan kanggo kekaisaran pusat data Nvidia.

Peluncuran kasebut, diumumake dina Selasa lan rinci ing kaca produk perusahaan lan gelombang jangkoan saka Reuters, Bloomberg lan The Register, menehi tandha refresh hardware sing paling penting saka Cerebras wiwit umum - lan wayahe penting kanggo perusahaan sing saham wis berjuang wiwit IPO. Investor katon menehi perhatian: saham Cerebras (CBRS) mundhak ing warta kasebut, lan Investor's Business Daily ngutip komentar CEO yen pasar inferensi AI "tuwuh kanthi cepet."

Kanggo para pamaca sing nglacak balapan sing nyepetake supaya model AI nanggapi luwih cepet, peluncuran CS-4 minangka salah sawijining crita hardware sing paling penting ing kuartal kasebut, lan ana ing tengah-tengah owah-owahan ing jangkoan industri AI sing terus ngowahi lanskap komputasi.

Apa Nang CS-4

Komponen utama yaiku WSE-3 Turbo, versi upgrade saka Mesin Skala Wafer ukuran piring Cerebras. Miturut nyilem jero teknis The Register, WSE-3T dudu silikon anyar - tetep proses TSMC 5nm sing padha, area mati 46,225 milimeter persegi, 4 triliun transistor, 900,000 inti lan 44 GB on-wafer SRAM minangka WSE-3 sing umur rong taun.

Nanging, Cerebras entuk kinerja tikel kaping pindho kanthi nyurung chip sing ana luwih angel. WSE-3T ngetung FP16 sing jarang dadi 250 petaFLOPS, ngganda kinerja FP16 sing padhet dadi kira-kira 25 petaFLOPS, ngganda bandwidth memori dadi 43,2 petabyte per detik, lan ngganda bandwidth I/O dadi 2,4 terabit per detik. Register ngira manawa perusahaan saiki nggawe jam silikon ing kira-kira 2.8 GHz, saka udakara 1.4 GHz ing generasi sadurunge.

Trik kasebut, miturut Cerebras, yaiku sistem pangiriman daya sing didesain ulang sing mung 0,5 milimeter saka prosesor - kira-kira 100 kaping luwih cedhak tinimbang ~ 50 milimeter khas saka papan GPU konvensional. Jarak kasebut meh ngilangi mundhut daya tingkat papan lan ngidini daya kaping pindho kanggo nggayuh wafer, mbisakake frekuensi operasi sing luwih dhuwur ing mburi generasi token sing luwih cepet.

Arsitektur Rak Nexus

Ngluwihi chip dhewe, CS-4 ngenalake apa sing diarani Cerebras Arsitektur Platform Nexus, desain skala rak sing bener lan jawaban langsung menyang sistem rak Nvidia NVL72 lan Helios AMD. Saben CS-4 bisa nggawa nganti telung pemroses WSE-3T sing ana ing "Ransel Wafer-Skala" - paket 3D sing melu wafer, konversi daya, pendinginan Cairan langsung, I / O kanthi kacepetan dhuwur lan elektronik kontrol dadi siji perakitan kanthi komponen 50% luwih sithik.

Desain modular misahake daya stabil, pendinginan lan lapisan jaringan saka komputasi. A Cerebras PowerRack bisa diinstal lan fasilitas-qualified sadurunge komputasi sembarang teka, lan tas ransel banjur geser menyang panggonan - ngurangi wektu penyebaran prajurit saka dina kanggo jam, miturut perusahaan.

konsumsi daya punika substansial. Register kira-kira udakara 46 kW saben tas ransel lan total sistem imbang 120 nganti 140 kW - nomer sing katon konservatif ing jejere sistem rak 240 nganti 250 kW AMD lan Nvidia samesthine bakal dikirim ing taun iki.

Mateni Ngalih

Mbok menawa pilihan sing paling menarik kanthi teknis yaiku interkoneksi. Tinimbang nuntun lalu lintas wafer-kanggo-wafer liwat switch - pendekatan AWS diadopsi kanggo akselerator Trainium3 sawijining - Cerebras kabel Kripik menyang topologi torus 2D ngendi wafer tetanggan ngomong langsung siji liyane. Desain kasebut nyuda latensi wafer-to-wafer saka limang mikrodetik dadi mung loro, lan Cerebras ujar manawa bolong kasebut bisa ndhukung model nganti 50 triliun paramèter, kanthi nyaman ngluwihi apa wae sing saiki ana.

Asil kacepetan striking. Ing siji sistem CS-4, perusahaan benchmarking Analisis Artificial ngukur nganti 4,400 token per detik saben pangguna ing gpt-oss-120b - kira-kira 12 kaping ~350 token per detik saka layanan inferensi basis GPU paling cepet sing kasedhiya saiki. Cerebras uga ngaku sistem ndhukung luwih saka 1.000 token per detik ing model ngluwihi 10 triliun paramèter.

Strategi Kemitraan Disaggregated

Utamane, Cerebras ora nyoba nglakokake kabeh pipa inferensi ing silikon dhewe. Perusahaan kasebut wis kerja sama karo AWS lan AMD kanggo ngilangi inferensi tahap pangolahan cepet-intensif komputasi menyang Trainium XPU lan Instinct GPU masing-masing, ninggalake mesin skala wafer kanggo nangani fase decode sensitif latensi ing ngendi cadangan SRAM sing gedhe banget.

Peluncuran CS-4 uga ngluwihi kolaborasi Cerebras karo OpenAI. Yahoo Finance nglaporake pambuka bareng karo kemitraan OpenAI lan AMD anyar sing dituju kanggo nyepetake inferensi AI - mbangun mode Ultrafast sing diluncurake perusahaan ing wulan Agustus, sing nggawa GPT-5.6 Sol menyang pangguna nganti 750 token per detik.

Peringatan Konco Nomer Headline

Analis industri njaluk ngati-ati babagan tokoh pemasaran. Register nyathet yen judhul Cerebras 250 petaFLOPS gumantung marang sparsity, sing umume ora entuk manfaat saka inferensi model basa sing gedhe, lan angka bandwidth memori puncak umume teoritis amarga WSE-3 ora duwe komputasi kanggo saturate SRAM dhewe. Publikasi uga takon kok Cerebras tikel kinerja tinimbang nambah kapasitas SRAM, kang wis ora meaningfully thukul wiwit WSE-2 dibukak limang taun kepungkur - pilihan penasaran ing jaman inferensi disaggregated ngendi decode accelerators entuk manfaat paling saka memori.

Isih, kesempatan pasar nyata. Amarga chatbots lan agen AI nuntut wektu nanggepi sing luwih cepet, kacepetan inferensi wis dadi pembeda kompetitif sing asli, lan Cerebras saiki wis nuduhake manawa bisa ngulang teknologi skala wafer sing ora konvensional ing irama komersial.

Pangiriman CS-4 pisanan diwiwiti kuartal iki, kanthi sistem pisanan sing dikarepake online sadurunge akhir September. Apa cukup kanggo nyuda dominasi Nvidia isih kudu dideleng - nanging kanggo sepisanan, inferensi AI paling cepet ing industri duwe alamat anyar.

Tetep Ahead saka AI

Hardware diluncurake kaya pasar pamindhahan CS-4 lan nemtokake maneh apa sing bisa ditindakake sistem AI. Waca liyane warta AI kanggo nglacak saben pembangunan.

Jelajahi liputan AI paling anyar →