Cerebras och OpenAI har gett världen en tidig titt på Ultrafast Mode, en ny tjänstenivå som lanseras först i OpenAI API och drivs av Cerebras hårdvara. Enligt Cerebras tillkännagivande som publicerades den 13 augusti 2026, levererar GPT-5.6 Sol som körs på Ultrafast upp till 750 utdatatokens per sekund — utan att kompromissa med kvaliteten.
Nivån är initialt tillgänglig för en utvald grupp av kunder, med åtkomst som utökas med tiden. Tillkännagivandet, skrivet av Cerebras Joyce Er, positionerar erbjudandet som en lösning på en avvägning som har definierat AI-produktutveckling i åratal: byggare var tvungna att välja mellan hastighet och intelligens, eftersom större och smartare modeller ådrar sig högre beräknings- och datarörelsekostnader som saktar ner svarstider. Läsare som följer kapplöpningen för att accelerera gränsmodeller kan följa den senaste utvecklingen på AI Buzz Wire.
Hur snabbt är ultrasnabbt, exakt?
Det råa genomströmningstalet är slående i sig, men Cerebras tillhandahöll också jämförande sammanhang. Enligt utmatningshastigheter som rapporterats av Artificial Analysis, en oberoende benchmarkingtjänst, körs GPT-5.6 Sol på Ultrafast-läge:
- 11 gånger snabbare än Fable 5
- 5 gånger snabbare än Opus 4.8 i snabbläge
För att stresstesta påståendet körde Cerebras modellen head-to-head mot populära konkurrenter på Humanity's Last Exam (HLE), ett utmanande riktmärke som består av 2 500 frågor som vanligtvis bara kan besvaras av personer som har doktorerat inom områden som kemi, ekonomi och litteratur.
Resultatet: GPT-5.6 Sol på Ultrafast svarade på alla 2 500 HLE-frågorna på 11 timmar och 11 minuter. Claude Fable 5 behövde 78 timmar och 27 minuter — mer än tre dagars kontinuerlig beräkning — för att komma fram till samma slutsatser. Med andra ord arbetade Ultrafast genom gränsen för mänsklig kunskap på en enda arbetsdag och uppnådde jämförbar noggrannhet nästan sju gånger snabbare.
Cerebras noterade sin benchmarking-metodik: GPT-5.6 Sol Ultrafast testades med Codex på xhigh resonemang den 10 juli, medan Claude Fable 5 testades med Claude Code på xhigh resonemang 13–15 juli.
Verkliga arbetsbelastningar, inte bara riktmärken
Hastighetsmått kan vara missvisande om kvaliteten försämras på vägen, varför Cerebras också lyfte fram resultat på GDP-Val, ett riktmärke för ekonomiskt värdefulla kunskapsarbetsuppgifter. På GDP-Val levererade Ultrafast en 5,6x end-to-end speedup utan kvalitetsförsämring, enligt tester som Cerebras körde den 31 juli 2026 med GPT-5.6 Sol och GPT-5.6 Sol Ultrafast på medium resonemang inom Codex.
Företaget säger att GPT-5.6 Sol är OpenAI:s bästa modell hittills för juridiska dokument, finansiella modeller och tekniska rapporter – domäner där utdatakvalitet och handläggningstid båda har direkta ekonomiska konsekvenser.
Varför hastighet ändrar agentekvationen
Den mer följdriktiga förändringen kan vara i hur AI-agenter fungerar. Snabbare slutsatser förändrar vad som är möjligt för individer och organisationer, eftersom agenter kan placeras på den kritiska vägen för problem där varje sekund räknas.
"Med GPT-5.6 Sol Ultrafast möjliggör Cerebras AI som hänger med i hur du tänker, kodar och samarbetar", säger Rohan Varma, produkt på OpenAI, i ett uttalande som citeras i tillkännagivandet. "Vi är glada över att se hur arbetsflöden och applikationer förvandlas av Ultrasnabb slutledning."
Cerebras beskrev flera scenarier med hög insats där snabbheten är viktig:
Incidentrespons
Företag som driver webbtjänster kan använda Ultrafast för att rotorsaka och åtgärda produktionsavbrott, bevara kundernas förtroende, förhindra förlorade intäkter och spara stilleståndsminuter mot sina SLA:er.Cybersäkerhet
I motstridiga cyberattacker med hög insats måste säkerhetsteam snabbt upptäcka och reagera på dåliga aktörer för att förhindra katastrofala förluster – en uppgift där slutledningslatens direkt påverkar skadekontroll.Agentproduktivitet
Ultrasnabb möjliggör nya sätt att arbeta med agenter genom att leverera insikter och uppdateringar i realtid, vilket minskar behovet av att kontextväxla över parallella sessioner."Medan jag tidigare kanske måste vänta ett par minuter på att en uppgift ska slutföras, slutar den nu för mig innan jag ens har möjlighet att byta kontext. Det gör mig mycket mer produktiv", säger Jeffrey Wang, forskare vid OpenAI, i tillkännagivandet.
Strategin bakom partnerskapet
För Cerebras representerar affären ytterligare en milstolpe i dess ansträngning att kommersialisera wafer-skalaacceleration för AI-inferens. För OpenAI lägger Ultrafast Mode till en premiumhastighetsnivå till sitt API i ett ögonblick då slutledningslatens har blivit en konkurrenskraftig differentiator – särskilt för agentapplikationer som kopplar ihop många modellsamtal, där per-samtal fördröjer sammansatta till minuter av väntan.
Företagen ramar in nivån som en beständig fördel för organisationer som använder frontier AI för att reagera snabbt på inkommande information, och para ihop Ultrasnabb bearbetning för tidskänsligt arbete med standardbearbetning för råvaruuppgifter som kan parallelliseras i bakgrunden.
Access rullar ut gradvis. Intresserade utvecklare kan övervaka OpenAI API-dokumentationen för tillgänglighet, eftersom Cerebras säger att åtkomsten kommer att utökas med tiden från den initiala utvalda gruppen kunder.
Ligg före AI
För mer täckning av hårdvaru- och infrastrukturkapplöpningen som omformar artificiell intelligens, bokmärk AI Buzz Wire och följ vårt AI-hårdvarunyheter-flöde.
Läs mer AI-nyheter →