Cerebras a OpenAI daly světu první pohled na Ultrafast Mode, novou úroveň služeb, která se jako první spouští v OpenAI API a je poháněna hardwarem Cerebras. Podle oznámení Cerebras zveřejněného 13. srpna 2026 poskytuje GPT-5.6 Sol běžící na Ultrafast až 750 výstupních tokenů za sekundu — bez kompromisů v kvalitě.
Úroveň je zpočátku dostupná pro vybranou skupinu zákazníků, přičemž přístup se postupem času rozšiřuje. Oznámení, které napsal Joyce Er z Cerebras, staví nabídku jako řešení kompromisu, který definoval vývoj produktů AI po léta: stavitelé si museli vybrat mezi rychlostí a inteligencí, protože větší a chytřejší modely vyžadují vyšší výpočetní náklady a náklady na přesun dat, což zpomaluje dobu odezvy. Čtenáři sledující závod o zrychlení hraničních modelů mohou sledovat nejnovější vývoj na [AI Buzz Wire] (https://aibuzzwire.news).
Jak rychle je ultrarychlé, přesně?
Hrubé číslo propustnosti je samo o sobě pozoruhodné, ale Cerebras také poskytl srovnávací kontext. Podle výstupních rychlostí, které uvádí Artificial Analysis, nezávislá srovnávací služba, GPT-5.6 Sol v režimu Ultrafast běží:
-11x rychlejší než Fable 5
- 5x rychlejší než Opus 4.8 v rychlém režimu
Aby toto tvrzení otestoval, Cerebras provedl model přímo proti populárním konkurentům na Humanity's Last Exam (HLE), náročném benchmarku sestávajícím z 2 500 otázek, na které obvykle odpovídají pouze lidé s doktorátem v oborech, jako je chemie, ekonomie a literatura.
Výsledek: GPT-5.6 Sol na Ultrafast odpověděl na všech 2 500 otázek HLE za 11 hodin a 11 minut. Claude Fable 5 potřeboval 78 hodin a 27 minut – více než tři dny nepřetržitého počítání – aby dospěl ke stejným závěrům. Jinými slovy, Ultrafast prošel hranicí lidského poznání za jediný pracovní den a dosáhl srovnatelné přesnosti téměř 7x rychleji.
Společnost Cerebras zaznamenala svou metodiku benchmarkingu: GPT-5.6 Sol Ultrafast byl testován pomocí Codex na xhigh uvažování 10. července, zatímco Claude Fable 5 byl testován s Claude Code na xhigh uvažování 13.–15. července.
Real-World Workloads, ne jen benchmarky
Rychlostní benchmarky mohou být zavádějící, pokud se kvalita postupem času zhoršuje, a proto Cerebras také zdůraznil výsledky GDP-Val, což je měřítko pro ekonomicky hodnotné úkoly znalostní práce. Podle testů, které Cerebras provedl 31. července 2026 s použitím GPT-5.6 Sol a GPT-5.6 Sol Ultrafast v rámci Codexu, dosáhl Ultrafast na GDP-Val 5,6x zrychlení end-to-end bez snížení kvality.
Společnost říká, že GPT-5.6 Sol je dosud nejlepším modelem OpenAI pro právní briefingy, finanční modely a technické zprávy – domény, kde kvalita výstupu a doba obratu mají přímé finanční důsledky.
Proč rychlost mění rovnici agenta
Důslednější posun může být v tom, jak agenti AI fungují. Rychlejší vyvozování mění to, co je možné pro jednotlivce a organizace, protože agenti se mohou dostat na kritickou cestu problémů, kde záleží na každé sekundě.
"S GPT-5.6 Sol Ultrafast Cerebras umožňuje AI, která drží krok s tím, jak myslíte, kódujete a spolupracujete," řekl Rohan Varma, produkt společnosti OpenAI, v prohlášení citovaném v oznámení. "Jsme nadšeni, když vidíme, jak jsou pracovní postupy a aplikace transformovány pomocí Ultrafast inference."
Cerebras nastínil několik scénářů s vysokými sázkami, kde na zrychlení záleží:
Reakce na incident
Společnosti provozující webové služby mohou použít Ultrafast ke kořenové příčině a řešení výpadků výroby, zachování důvěry zákazníků, zabránění ztrátě příjmů a úspoře minut prostojů oproti svým SLA.Kybernetická bezpečnost
V nepřátelských kybernetických útocích musí bezpečnostní týmy rychle odhalit špatné aktéry a reagovat na ně, aby zabránily katastrofickým ztrátám – což je úkol, kde latence odvození přímo ovlivňuje kontrolu škod.Produktivita agentů
Ultrafast umožňuje nové způsoby práce s agenty poskytováním přehledů a aktualizací v reálném čase, což snižuje potřebu přepínat kontext mezi paralelními relacemi."Zatímco dříve jsem možná musel čekat pár minut na dokončení úkolu, teď to pro mě skončí dříve, než budu mít příležitost přepnout kontext. Díky tomu jsem mnohem produktivnější," řekl Jeffrey Wang, výzkumník z OpenAI, v oznámení.
Strategie v pozadí partnerství
Pro Cerebras představuje tato dohoda další milník v jejím úsilí o komercializaci akcelerace v waferovém měřítku pro odvození AI. Pro OpenAI přidává Ultrafast Mode do svého API prémiovou rychlostní úroveň v okamžiku, kdy se inferenční latence stala konkurenčním rozlišovacím znakem – zejména pro agentní aplikace, které řetězí mnoho modelových volání dohromady, kde jednotlivá volání zpožďují minuty čekání.
Společnosti formulují vrstvu jako trvalou výhodu pro organizace využívající hraniční umělou inteligenci k rychlé reakci na příchozí informace, přičemž spojují ultrarychlé zpracování pro časově citlivou práci se standardním zpracováním pro komoditní úlohy, které lze paralelizovat na pozadí.
Přístup se postupně rozšiřuje. Zainteresovaní vývojáři mohou sledovat dostupnost dokumentace OpenAI API, protože Cerebras říká, že přístup se časem rozšíří z počáteční vybrané skupiny zákazníků.
Udržujte si náskok před AI
Chcete-li získat další informace o závodech v oblasti hardwaru a infrastruktury, které přetvářejí umělou inteligenci, přidejte si AI Buzz Wire do záložek a sledujte náš kanál Aktuality o hardwaru AI.
Přečtěte si další zprávy o AI →