Cerebras și OpenAI au oferit lumii o privire devreme asupra Ultrafast Mode, un nou nivel de servicii care se lansează mai întâi în API-ul OpenAI și este alimentat de hardware Cerebras. Conform anunțului Cerebras publicat pe 13 august 2026, GPT-5.6 Sol rulează pe Ultrafast oferă până la 750 de jetoane de ieșire pe secundă - fără compromisuri în ceea ce privește calitatea.

Nivelul este inițial disponibil pentru un grup select de clienți, accesul care se extinde în timp. Anunțul, scris de Joyce Er de la Cerebras, poziționează oferta ca o soluție la un compromis care a definit dezvoltarea de produse AI de ani de zile: constructorii au trebuit să aleagă între viteză și inteligență, deoarece modelele mai mari și mai inteligente implică costuri mai mari de calcul și de mișcare a datelor care încetinesc timpii de răspuns. Cititorii care urmează cursa pentru accelerarea modelelor de frontieră pot urmări cele mai recente evoluții pe AI Buzz Wire.

Cât de rapid este ultrarapid, exact?

Numărul de producție brută este uimitor de la sine, dar Cerebras a furnizat și context comparativ. Conform vitezelor de ieșire raportate de Artificial Analysis, un serviciu independent de analiză comparativă, GPT-5.6 Sol în modul Ultrarapid rulează:

  • 11x mai rapid decât Fable 5
  • De 5 ori mai rapid decât Opus 4.8 în modul rapid

Pentru a testa afirmația, Cerebras a condus modelul față în față împotriva concurenților populari la Umanity's Last Exam (HLE), un etalon de referință provocator format din 2.500 de întrebări la care răspund de obicei doar persoanele care dețin doctorat în domenii precum chimie, economie și literatură.

Rezultatul: GPT-5.6 Sol pe Ultrafast a răspuns la toate cele 2.500 de întrebări HLE în 11 ore și 11 minute. Claude Fable 5 a avut nevoie de 78 de ore și 27 de minute — mai mult de trei zile de calcul continuu — pentru a ajunge la aceleași concluzii. Cu alte cuvinte, Ultrafast a trecut de granița cunoștințelor umane într-o singură zi de lucru, obținând o precizie comparabilă de aproape 7 ori mai rapidă.

Cerebras și-a remarcat metodologia de evaluare comparativă: GPT-5.6 Sol Ultrafast a fost testat cu Codex pe xhigh raționament pe 10 iulie, în timp ce Claude Fable 5 a fost testat cu Claude Code pe xhigh raționament 13-15 iulie.

Sarcini de lucru din lumea reală, nu doar puncte de referință

Valorile de referință ale vitezei pot induce în eroare dacă calitatea se degradează pe parcurs, motiv pentru care Cerebras a evidențiat și rezultatele privind GDP-Val, un etalon pentru sarcinile de lucru cu cunoștințe valoroase din punct de vedere economic. Pe GDP-Val, Ultrafast a furnizat o accelerare de 5,6 ori de la capăt la capăt, fără degradare a calității**, conform testelor efectuate de Cerebras pe 31 iulie 2026 folosind GPT-5.6 Sol și GPT-5.6 Sol Ultrafast pe raționament mediu în Codex.

Compania spune că GPT-5.6 Sol este cel mai bun model OpenAI de până acum pentru documente juridice, modele financiare și rapoarte de inginerie - domenii în care calitatea rezultatelor și timpul de răspuns au consecințe financiare directe.

De ce viteza modifică ecuația agentului

Schimbarea mai semnificativă poate fi în modul în care funcționează agenții AI. Inferența mai rapidă schimbă ceea ce este posibil pentru indivizi și organizații, deoarece agenții pot fi plasați pe calea critică a problemelor în care fiecare secundă contează.

„Cu GPT-5.6 Sol Ultrafast, Cerebras permite AI care ține pasul cu modul în care gândiți, codificați și colaborați”, a declarat Rohan Varma, Product la OpenAI, într-o declarație citată în anunț. „Suntem încântați să vedem cum fluxurile de lucru și aplicațiile sunt transformate prin inferență ultrarapidă.”

Cerebras a subliniat mai multe scenarii cu mize mari în care accelerarea contează:

Răspuns la incident

Companiile care operează servicii web pot folosi Ultrafast pentru a identifica și rezolva întreruperile producției, păstrând încrederea clienților, prevenind pierderea veniturilor și economisind minutele de nefuncționare față de SLA-urile lor.

Securitate cibernetică

În atacurile cibernetice adverse, cu mize mari, echipele de securitate trebuie să detecteze și să răspundă rapid actorilor răi pentru a limita pierderile catastrofale - o sarcină în care latența de inferență afectează direct controlul daunelor.

Productivitatea agentului

Ultrarapid permite noi moduri de lucru cu agenții prin furnizarea de informații și actualizări în timp real, reducând nevoia de a comuta contextul între sesiuni paralele.

„În timp ce înainte ar fi trebuit să aștept câteva minute pentru ca o sarcină să se termine, acum se termină pentru mine înainte chiar să am ocazia să schimb contextul. Mă face mult mai productiv”, a spus Jeffrey Wang, cercetător la OpenAI, în anunț.

Strategia din spatele parteneriatului

Pentru Cerebras, acordul reprezintă o altă piatră de hotar în efortul său de a comercializa accelerarea la scară de wafer pentru inferența AI. Pentru OpenAI, Ultrafast Mode adaugă un nivel de viteză premium la API-ul său într-un moment în care latența de inferență a devenit un factor de diferențiere competitiv – în special pentru aplicațiile agentice care conectează multe apeluri model, unde întârzierile per apel se transformă în minute de așteptare.

Companiile încadrează nivelul ca un avantaj persistent pentru organizațiile care folosesc AI de frontieră pentru a răspunde rapid la informațiile primite, asociind procesarea ultrarapidă pentru lucrul care necesită timp cu procesarea standard pentru sarcinile de mărfuri care pot fi paralelizate în fundal.

Accesul se extinde treptat. Dezvoltatorii interesați pot monitoriza documentația OpenAI API pentru disponibilitate, deoarece Cerebras spune că accesul se va extinde în timp de la grupul inițial selectat de clienți.

Rămâi înaintea AI

Pentru mai multă acoperire a cursei hardware și infrastructurii care remodelează inteligența artificială, marcați AI Buzz Wire și urmăriți feedul nostru AI hardware news.

Citiți mai multe știri AI →