OpenAI a remediat trei defecte despre care spune că explică o săptămână de plângeri ale utilizatorilor că GPT-6 Astra, cel mai nou model de frontieră, a devenit mai prost de la lansare - și resetează limitele de utilizare pentru abonații Codex ca un fel de scuze. Actualizarea a venit de la liderul de produse Codex, Tibo Sottiaux, care a spus că echipa a lucrat cu utilizatorii pentru a urmări defecțiunile, apoi a livrat remedieri și o resetare completă a utilizării înainte de miezul nopții, ora locală, potrivit unei actualizări publicate sâmbătă.

Admiterea închide o perioadă dificilă pentru ceea ce OpenAI a considerat modelul său cel mai capabil de până acum. De când Astra a atins o disponibilitate largă la începutul lunii septembrie, dezvoltatorii de pe X au rulat solicitări identice împotriva Astra din ziua lansării și a versiunii actuale, păstrând fiecare setare la fel și postând comparații una lângă alta care păreau să arate un model slab slăbit. Pentru mai multe despre modelele care conduc această dezbatere, consultați ultimele dezvoltări AI acoperirea noastră.

Cele trei defecte, numite

Potrivit lui Sottiaux, primul vinovat au fost abilitățile – fișiere prompte scrise pentru modelele anterioare care se declanșau prea des sub Astra, oprește uneori modelul să își verifice propria activitate. Al doilea a fost un experiment opțional de gestionare a contextului care ar putea face ca modelul să renunțe mai devreme sau să răspundă la mesaje învechite. OpenAI a dezactivat experimentul după ce aproximativ 4.000 până la 5.000 de utilizatori au fost afectați, a spus compania.

Al treilea defect a implicat mai degrabă infrastructura decât modelul în sine: unele motoare de inferență au fost configurate incorect și au degradat măsurabil calitatea traficului de coadă direcționat prin ele. OpenAI a scos acele motoare și a făcut câteva reparații mai mici. Sottiaux a scris că modelul urmărește acum cel mai recent mesaj al utilizatorului cu mai multă acuratețe - un semn din cap la plângerile conform cărora Astra a răspuns la întrebările pe care utilizatorul le-a trecut deja.

Dezvoltatorii au trecut deja mai departe

Plângerile s-au acumulat de-a lungul săptămânii. Dezvoltatorul Pranjal Paliwal, care îl lăudase pe Astra cu câteva zile în urmă, s-a întors și a citit codul pe care l-a scris pentru el, apoi a numit rezultatul mai degrabă o regresie decât un progres. Dax Raad, care creează instrumentul de codare Opencode, și-a mutat echipa înapoi la vechiul GPT-5.6 Sol după ce a dublat cheltuielile pe Astra pentru dezavantaje pe care le-a considerat că nu merită banii. Un poster pe forum a descris-o pe Astra ca fiind acum la nivel cu Sol pe sarcini identice, cu aceleași încercări.

Nu toată lumea a acceptat această lectură. Un utilizator pseudonim care scria ca Antikythera a susținut că modelul a fost întotdeauna leneș și pasionat de punctele marcante și că utilizatorii au încetat pur și simplu să fie orbiți. Acest dezacord surprinde cât de greu sunt de soluționat afirmațiile privind calitatea modelului: solicitări identice, verdicte diferite.

Probleme de capacitate în fundal

Rândul de calitate a aterizat în timp ce capacitatea a umbrit lansarea. OpenAI a redus limitele de utilizare Astra pentru utilizatorii ChatGPT mari, conform rapoartelor utilizatorilor, și a întrerupt noile abonamente Pro de 200 USD – un pas pe care Sottiaux a confirmat-o pe 10 septembrie, invocând cererea. Modelul încă costă 10 USD per milion de jetoane de intrare și 50 USD per milion de jetoane de ieșire, care este de 2,5 ori mai mult decât a perceput Sol la lansare.

Există, de asemenea, un precedent inconfortabil: acesta este al doilea flagship OpenAI în două luni care atrage aceeași acuzație din partea utilizatorilor plătitori. În iulie, utilizatorii au spus că modul de raționament de top al lui Sol a devenit superficial peste noapte. Sottiaux a negat că a slăbit-o în mod deliberat la acea vreme, confirmând în același timp că compania a experimentat un efort de raționament. Ciclurile repetate de „modelul s-a înrăutățit” urmate de „am găsit defecte” devin un model pe care compania va trebui să-l gestioneze – transparența ajută, dar și stabilitatea va ajuta.

Sfatul propriu al OpenAI: Folosiți mai puține balustrade

Pe lângă remedieri, OpenAI a publicat un ghid de migrare de la inginerul Eric Provencher, care echivalează cu o recomandare contraintuitivă: modelele mai capabile au nevoie de mai puțină ținere de mână. Descrierile de abilități prea lungi, cerințele generale de citire și regulile de aprobare rigide pot fi în calea Astrei, se arată în ghid. Instrucțiunile care s-au acumulat de-a lungul timpului pot mânca contextul sau pot determina ca modelul să nu mai funcționeze prea devreme.

Provencher recomandă echipelor să-și revizuiască abilitățile, fișierele AGENTS.md și solicitările de sarcină ori de câte ori schimbă modelele, leagă instrucțiunile strâns la sarcini specifice și definește clar când se termină o lucrare - deoarece, chiar și fără restricții, Astra se poate opri mai devreme decât GPT-5.6 Sol. Echipele care au blocat lucrurile după ce modelele anterioare au devenit necinstite ar trebui să revizuiască acele reguli: Astra are o judecată mai bună, argumentează postarea, dar poate interpreta vechile restricții atât de literal, încât se oprește atunci când vrei să continue.

Ce se întâmplă în continuare

Resetarea utilizării le oferă abonaților Codex o listă liberă pentru a reevalua modelul, iar OpenAI va urmări aceleași teste paralele pe care le fac utilizatorii săi. Întrebarea mai profundă este încrederea: dezvoltatorii plătitori care au văzut un produs emblematic degradat în decurs de o săptămână de la lansare au acum o explicație documentată, trei defecte denumite și o resetare - dar și un nou motiv pentru a compara fiecare actualizare de model față de ziua în care a fost livrat.

Stai înaintea AI

Lansările de modele, defectele post-mortems și instrumentele de remodelare a software-ului funcționează - urmărite în fiecare zi.

Citiți mai multe știri AI →