OpenAI heeft stilletjes het werkcontextvenster voor zijn Codex-codeeragent en de onderliggende GPT-5.6-modelfamilie verkleind, waardoor de bruikbare limiet is teruggebracht van ongeveer 372.000 tokens naar 272.000 tokens. De verandering, die aan het licht kwam via een samengevoegd pull-verzoek in de open-source Codex-repository van het bedrijf, heeft scherpe reacties opgeleverd van ontwikkelaars die afhankelijk zijn van grote contexten om hele codebases in één keer te analyseren.
De aanpassing weerspiegelt een bekende spanning in de AI-industrie, waar bedrijven de kosten van gevolgtrekkingen uit de lange context afwegen tegen het gemak dat het gebruikers biedt. Voor de nieuwste berichtgeving over de AI-industrie (https://aibuzzwire.news) onderstreept deze stap hoe zelfs kleine wijzigingen in de metadata van modellen door miljoenen workflows van ontwikkelaars kunnen worden doorgevoerd.
Wat er is veranderd en waar het is opgemerkt
De reductie werd zichtbaar in het gebundelde model-metadatabestand van de Codex-repository, `codex-rs/models-manager/models.json`. Een pull-verzoek met de titel "Backport vernieuwde gebundelde model-metagegevens naar 0.144", geschreven door OpenAI-ingenieur Sayan-oai en samengevoegd op 18 juli 2026, vernieuwde de metagegevens die stabiele Codex-clients gebruiken om de mogelijkheden van elk model te begrijpen.
Het huidige bestand toont een `context_window`-waarde van 272.000 tokens over de GPT-5.6-reeks, inclusief de varianten GPT-5.6-Sol, GPT-5.6-Terra en GPT-5.6-Luna, evenals oudere GPT-5.5- en GPT-5.2-vermeldingen. Volgens de discussie op Hacker News, waar de wijziging meer dan 350 stemmen opleverde, bedroeg de eerdere werklimiet ongeveer 372.000 tokens. Sommige modellen behouden een hoger `max_context_window` van maximaal één miljoen tokens, maar het standaardvenster dat clients daadwerkelijk aanvragen, bedraagt nu maximaal 272.000.
Dat onderscheid is van belang. Het maximale contextvenster vertegenwoordigt wat het model theoretisch zou kunnen accepteren, terwijl het werkende `context_window` is wat de Codex-client standaard is geconfigureerd om te verzenden. In de praktijk betekent dit dat ontwikkelaars die de agent voorheen honderdduizenden tokens broncode gaven, nu eerder tegen het plafond aanlopen.
Waarom contextlengte belangrijk is voor codeeragenten
Voor een codeeragent als Codex is het contextvenster geen ijdelheidsmetriek. Het bepaalt hoeveel van een repository het model in één keer kan "zien" bij het redeneren over een bug, het genereren van een functie of het refactoren van een module. Een daling van 100.000 tokens betekent dat er ongeveer 75.000 minder woorden aan code, opmerkingen en documentatie in één enkele prompt worden geladen.
In de praktijk kan dat het verschil zijn tussen een agent die een volledige microservice end-to-end begrijpt en moet werken met een gedeeltelijk, ingekort beeld. Ontwikkelaars die aan grote monorepo's werken of ingrijpende migraties tussen bestanden uitvoeren, worden het meest getroffen, omdat hun taken afhankelijk zijn van het tegelijkertijd in context houden van veel bestanden.
De verandering komt doordat agentische codeertools agressief concurreren over de hoeveelheid context die ze aankunnen. Rivalen hebben enorme contextvensters op de markt gebracht als een belangrijk verkoopargument, waarbij ze de mogelijkheid om hele codebases te verwerken beschouwen als de weg naar echte autonome software-engineering. De pullback van OpenAI verkleint die kloof op het standaardniveau.
Kosten, kwaliteit en de economie van een lange context
De waarschijnlijke motivatie zijn de kosten. Langere contexten zijn dramatisch duurder om te verwerken, zowel wat betreft rekenkracht als latentie, omdat het model elk token in de invoer moet controleren. Hoge 'naald in een hooiberg'-foutpercentages hebben ook de neiging om binnen te sluipen naarmate de context zich uitbreidt, wat betekent dat modellen soms informatie missen die diep in een lange prompt verborgen ligt. Het beperken van het standaardvenster kan deze nauwkeurigheidsproblemen verminderen en tegelijkertijd de uitgaven voor inferentie beperken.
OpenAI heeft geen aparte aankondiging gepubliceerd waarin de verlaging wordt uitgelegd. De wijziging ging alleen via het vernieuwen van de metagegevens en de backport naar releaseregel 0.144, de vertakking die naar de meeste niet-alfacodexgebruikers wordt verzonden. Die onopvallende uitrol is op zichzelf opmerkelijk: een beslissing die rechtstreeks van invloed is op de productiviteit van ontwikkelaars, werd gecommuniceerd via een codediff in plaats van via een blogpost of changelog.
Voor teams is de praktische implicatie eenvoudig. Taken die voorheen binnen één contextpassage pasten, vereisen nu mogelijk dat het werk in kleinere stukken moet worden gesplitst, dat relevante bestanden selectiever moeten worden opgehaald of dat moet worden geaccepteerd dat de agent een kleiner gezichtsveld heeft. Sommige ontwikkelaars kunnen de limiet omzeilen door te vertrouwen op het hogere `max_context_window`, indien beschikbaar, hoewel dit doorgaans expliciete configuratie vereist.
Een breder patroon van stille aanpassingen
De contextverlaging van de Codex past in een breder industriepatroon waarin AI-laboratoria de parameters van hun modellen afstemmen tussen de belangrijkste lanceringen. Venstergroottes, tarieflimieten en standaardgedrag worden regelmatig aangepast via infrastructuurupdates die nooit een persbericht bereiken. Ontwikkelaars die afhankelijk zijn van deze systemen kijken steeds vaker naar de onderliggende opslagplaatsen en API-reacties op vroege signalen.
De stap van OpenAI benadrukt ook de kloof tussen marketing en realiteit. Een model kan de lengte van de koptekst ondersteunen, maar het effectieve venster dat producten feitelijk blootleggen kan aanzienlijk kleiner zijn, gevormd door kostenbeslissingen die aanbieders namens gebruikers nemen.
Blijf AI een stap voor
Modelparameters veranderen voortdurend, en de tools waarvan ontwikkelaars afhankelijk zijn, kunnen van de ene op de andere dag veranderen. Voor tijdige rapportage over releases, capaciteitswijzigingen en de economie van grensverleggende AI, volgt u het breaking AI news op AI Buzz Wire.
Lees meer AI-nieuws →


