OpenAI heeft drie defecten verholpen die naar eigen zeggen een week van klachten van gebruikers verklaren dat GPT-6 Astra, het nieuwste grensmodel, dommer was geworden sinds de lancering – en het stelt de gebruikslimieten voor Codex-abonnees opnieuw in als een soort verontschuldiging. De update kwam van Codex-productleider Tibo Sottiaux, die zei dat het team met gebruikers samenwerkte om de fouten op te sporen en vervolgens voor middernacht lokale tijd oplossingen en een volledige gebruiksreset stuurde, volgens een update die zaterdag werd gepubliceerd.

De toelating sluit een moeilijke periode af voor wat OpenAI heeft aangekondigd als het meest capabele model tot nu toe. Sinds Astra begin september op grote schaal beschikbaar kwam, hadden ontwikkelaars op X identieke prompts uitgevoerd tegen Astra op de lanceringsdag en de huidige versie, waarbij elke instelling hetzelfde bleef, en zij-aan-zij vergelijkingen plaatsten die een stilletjes verzwakt model leken te laten zien. Voor meer informatie over de modellen die dit debat aandrijven, zie onze laatste AI-ontwikkelingen berichtgeving.

De drie defecten, genoemd

Volgens Sottiaux was de eerste boosdoener vaardigheden: promptbestanden geschreven voor eerdere modellen die te vaak activeerden onder Astra, waardoor het model soms zijn eigen werk niet kon controleren. De tweede was een optioneel contextbeheerexperiment waardoor het model vroegtijdig kon stoppen of op verouderde berichten kon reageren. OpenAI schakelde het experiment uit nadat ongeveer 4.000 tot 5.000 gebruikers getroffen waren, aldus het bedrijf.

Het derde defect betrof de infrastructuur en niet het model zelf: sommige inferentiemotoren waren onjuist geconfigureerd en de kwaliteit van het staartverkeer dat erdoorheen werd geleid, was meetbaar verslechterd. OpenAI verwijderde die motoren en voerde verschillende kleinere reparaties uit. Sottiaux schreef dat het model nu het laatste bericht van een gebruiker nauwkeuriger volgt – een knipoog naar klachten dat Astra vragen had beantwoord waar de gebruiker al voorbij was gegaan.

Ontwikkelaars waren al verder gegaan

De klachten stapelden zich gedurende de week op. Ontwikkelaar Pranjal Paliwal, die Astra dagen eerder had geprezen, ging terug en las de code die het voor hem schreef, en noemde de uitkomst vervolgens een achteruitgang in plaats van een vooruitgang. Dax Raad, die de codeertool Opencode bouwt, verhuisde zijn team terug naar de oudere GPT-5.6 Sol nadat de uitgaven aan Astra waren verdubbeld vanwege de nadelen die volgens hem het geld niet waard waren. Op een forumposter werd beschreven dat Astra nu op hetzelfde niveau staat als Sol voor identieke taken, met dezelfde nieuwe pogingen.

Niet iedereen accepteerde die lezing. Een pseudonieme gebruiker die, zoals Antikythera schreef, betoogde dat het model altijd lui was geweest en dol was op opsommingen, en dat gebruikers simpelweg niet meer verblind waren. Dat meningsverschil laat zien hoe moeilijk het is om claims over de kwaliteit van modellen te schikken: identieke aanwijzingen, verschillende uitspraken.

Capaciteitsproblemen op de achtergrond

De kwaliteitsrij kwam terecht terwijl de capaciteit de uitrol overschaduwde. OpenAI heeft volgens gebruikersrapporten de Astra-gebruikslimieten voor zware ChatGPT-gebruikers verlaagd en nieuwe Pro-abonnementen van $ 200 gepauzeerd – een stap die Sottiaux op 10 september bevestigde, daarbij verwijzend naar de vraag. Het model kost nog steeds $10 per miljoen inputtokens en $50 per miljoen outputtokens, wat 2,5 keer is wat Sol in rekening bracht toen het werd gelanceerd.

Er is ook een ongemakkelijk precedent: dit is het tweede OpenAI-vlaggenschip in twee maanden dat dezelfde beschuldiging uitgaat van betalende gebruikers. In juli zeiden gebruikers dat de belangrijkste redeneermodus van Sol van de ene op de andere dag oppervlakkig was geworden. Sottiaux ontkende destijds dat hij het opzettelijk had verzwakt, terwijl hij bevestigde dat het bedrijf had geëxperimenteerd met redeneerinspanningen. Herhaalde cycli van ‘het model werd slechter’ gevolgd door ‘we hebben gebreken gevonden’ worden een patroon waar het bedrijf mee zal moeten omgaan – transparantie helpt, maar stabiliteit ook.

OpenAI's eigen advies: gebruik minder vangrails

Naast de oplossingen publiceerde OpenAI migratierichtlijnen van ingenieur Eric Provencher die neerkomen op een contra-intuïtieve aanbeveling: capabelere modellen hebben minder handbediening nodig. Te lange vaardigheidsbeschrijvingen, algemene leesvereisten en strenge goedkeuringsregels kunnen Astra in de weg staan, aldus de richtlijnen. Instructies die zich in de loop van de tijd hebben opgestapeld, kunnen de context opvreten of ervoor zorgen dat het model te vroeg stopt met werken.

Provencher raadt teams aan om hun vaardigheden, AGENTS.md-bestanden en taakaanwijzingen te beoordelen wanneer ze van model wisselen, instructies nauw aan specifieke taken te koppelen en duidelijk te definiëren wanneer een taak klaar is – want zelfs zonder beperkingen kan Astra eerder stoppen dan GPT-5.6 Sol deed. Teams die zaken op slot deden nadat eerdere modellen schurkenstaten waren, moeten die regels opnieuw bekijken: Astra heeft een beter beoordelingsvermogen, betoogt de post, maar het kan oude beperkingen zo letterlijk interpreteren dat het stopt wanneer je wilt dat het doorgaat.

Wat gebeurt er vervolgens

De gebruiksreset geeft Codex-abonnees een schone lei om het model opnieuw te evalueren, en OpenAI zal dezelfde zij-aan-zij-tests bekijken die zijn gebruikers uitvoeren. De diepere vraag is vertrouwen: betalende ontwikkelaars die een vlaggenschip binnen een week na de lancering zagen degraderen, hebben nu een gedocumenteerde verklaring, drie benoemde defecten en een reset – maar ook een nieuwe reden om elke modelupdate te vergelijken met de dag waarop deze werd verzonden.

Blijf AI een stap voor

Lancering van modellen, post-mortems van defecten en de tools die softwarewerk hervormen – worden elke dag bijgehouden.

Lees meer AI-nieuws →