Společnosti Cerebras Systems a OpenAI se podělily o první pohled na Ultrafast Mode, novou úroveň služeb, která byla poprvé spuštěna v OpenAI API a je poháněna technologií wafer-scale Cerebras. Toto partnerství umožňuje GPT-5.6 Sol běžet rychlostí až 750 výstupních tokenů za sekundu, čímž poskytuje hraniční inteligenci rychlostí v reálném čase. Nejnovější zprávy o hardwaru AI najdete na [AI Buzz Wire] (https://aibuzzwire.news).
Eliminace kompromisu mezi rychlostí a inteligencí
Tvůrci umělé inteligence již dlouho čelí zásadnímu kompromisu: jak se modely zvětšují co do velikosti a inteligence, mají vyšší náklady na výpočetní techniku a přesun dat, což zpomaluje dobu odezvy. Vývojáři byli nuceni volit mezi čekáním na kvalitní výsledky nebo přijetím horších výsledků za kratší dobu.
GPT-5.6 Sol v režimu Ultrafast je navržen tak, aby toto dilema vyřešil. Podle Cerebras služba běží 11krát rychleji než Anthropic's Claude Fable 5 a 5krát rychleji než Opus 4.8 v režimu Fast, na základě výstupních rychlostí hlášených Artificial Analysis.
Poslední zkouška lidstva: Test rychlosti
Společnost Cerebras testovala Ultrafast proti konkurenčním modelům na Humanity's Last Exam (HLE), náročném benchmarku skládajícím se z 2 500 otázek, na které obvykle odpovídají pouze ti, kdo mají doktorát v oborech, jako je chemie, ekonomie a literatura.
V hodnoceních provedených společností Cerebras odpověděl GPT-5.6 Sol v režimu Ultrafast na všech 2 500 otázek HLE za 11 hodin a 11 minut. Claude Fable 5 potřeboval 78 hodin a 27 minut, více než tři dny nepřetržitého počítání, aby dospěl ke stejným závěrům. Jinými slovy, Ultrafast zpracoval hranici lidského poznání za jediný pracovní den a dosáhl srovnatelné přesnosti téměř sedmkrát rychleji.
Benchmarking provedl Cerebras pomocí GPT-5.6 Sol Ultrafast s Codexem pro vysoké nastavení uvažování 10. července a Claude Fable 5 s Claude Code s vysokým nastavením uvažování od 13. do 15. července.
Dopad na podnikání ve skutečném světě
Na GDP-Val, benchmarku pro ekonomicky hodnotné úkoly znalostní práce, Ultrafast zajistil 5,6násobné zrychlení end-to-end bez snížení kvality. To ukazuje, jak rychlejší odvození může urychlit ekonomicky hodnotnou práci bez obětování kvality výstupu.
Cerebras si představuje Ultrafast jako nástroj pro scénáře, kde záleží na každé vteřině. Společnosti provozující webové služby by mohly tuto technologii využít k rychlejšímu odhalování a řešení výpadků výroby, zachování důvěry zákazníků a zabránění ztrátě příjmů. V situacích vysoké kybernetické bezpečnosti by bezpečnostní týmy mohly využít Ultrafast k rychlé detekci a reakci na útoky.
Technologie stojící za rychlostí
Výkonnostní výhoda pramení z architektury Wafer-Scale Engine od Cerebras, která je účelově vytvořena pro hraniční pracovní zátěže AI. Hlavní výzvou rychlého vyvozování hranic je problém s přesunem dat: na tradičních GPU je vyvozování u velkých modelů omezeno šířkou pásma paměti, protože váhy modelu musí být opakovaně přenášeny mezi pamětí na čipu a úložištěm mimo čip, aby se generovaly po sobě jdoucí tokeny.
Cerebras má zásadně odlišný přístup. Každý čip o velikosti wafer obsahuje 44 GB paměti SRAM přímo na křemíku. Hmotnosti modelů zůstávají na čipu a tokeny plynule proudí vrstvami modelu propojenými přes wafery. To eliminuje neefektivní přesun dat, který zpomaluje vyvozování založené na GPU a plynule se škáluje s velikostí modelu, čímž se otevírá cesta pro pokračující rychlostní výhodu u budoucích hraničních modelů.
Dostupnost a postavení na trhu
GPT-5.6 Sol v režimu Ultrafast Mode je aktuálně k dispozici v omezené verzi pro vybranou skupinu zákazníků, přičemž přístup se postupem času rozšiřuje s rostoucí kapacitou. Cerebras popisuje partnerství jako hnací sílu další vlny inovací AI a zvýšení stropu toho, čeho mohou organizace dosáhnout s responzivní AI.
Spolupráce představuje významný milník pro společnost Cerebras, která již dlouho usiluje o výpočetní techniku v waferovém měřítku jako alternativu k hardwarovému trhu s umělou inteligencí, kterému dominuje GPU. Díky přímému partnerství s OpenAI za účelem urychlení jednoho z nejschopnějších dostupných hraničních modelů Cerebras jasně dokazuje, že jeho architektura nabízí skutečnou konkurenční výhodu pro vysokorychlostní inferenční úlohy.
Vzhledem k tomu, že se modely stále zvětšují a jsou inteligentnější, schopnost obsluhovat je rychlostí v reálném čase by se mohla stát určujícím konkurenčním faktorem na trhu infrastruktury AI. Partnerství Cerebras-OpenAI signalizuje, že závod o rychlost odvození je nyní stejně důležitý jako závod o inteligenci modelu.
Udržujte si náskok před AI
Chcete-li získat další novinky o hardwaru AI, analýzu výkonu modelu a vývoj v oboru, přidejte si do záložek [AI Buzz Wire] (https://aibuzzwire.news).
Přečtěte si další zprávy o AI →