OpenAI ha silenziosamente ridotto la finestra del contesto di lavoro per il suo agente di codifica Codex e la famiglia di modelli GPT-5.6 sottostante, tagliando il limite utilizzabile da circa 372.000 token a 272.000 token. Il cambiamento, emerso attraverso una richiesta pull unita sul repository Codex open source dell'azienda, ha suscitato forti reazioni da parte degli sviluppatori che si affidano a contesti di grandi dimensioni per analizzare intere basi di codice in un unico passaggio.

L’aggiustamento riflette una tensione familiare nel settore dell’intelligenza artificiale, in cui le aziende bilanciano il costo dell’inferenza a lungo contesto con la comodità che offre agli utenti. Per l’ultima copertura del settore dell’intelligenza artificiale, la mossa sottolinea come anche piccole modifiche ai metadati del modello possano propagarsi a milioni di flussi di lavoro degli sviluppatori.

Cosa è cambiato e dove è stato avvistato

La riduzione è diventata visibile nel file di metadati del modello in bundle del repository Codex, "codex-rs/models-manager/models.json". Una richiesta pull intitolata "Backport ha aggiornato i metadati del modello in bundle a 0.144", creata dall'ingegnere OpenAI sayan-oai e fusa il 18 luglio 2026, ha aggiornato i metadati utilizzati dai client Codex stabili per comprendere le capacità di ciascun modello.

Il file corrente mostra un valore "context_window" di 272.000 token nella gamma GPT-5.6, incluse le varianti GPT-5.6-Sol, GPT-5.6-Terra e GPT-5.6-Luna, nonché le voci GPT-5.5 e GPT-5.2 precedenti. Secondo la discussione su Hacker News, dove la modifica ha ottenuto più di 350 voti positivi, il limite operativo precedente era di circa 372.000 token. Alcuni modelli mantengono una "max_context_window" più alta, fino a un milione di token, ma la finestra predefinita che i client effettivamente richiedono ora è limitata a 272.000.

Questa distinzione è importante. La finestra di contesto massima rappresenta ciò che il modello potrebbe teoricamente accettare, mentre la "finestra_contesto" di lavoro è ciò che il client Codex è configurato per inviare per impostazione predefinita. In pratica, ciò significa che gli sviluppatori che in precedenza fornivano all’agente centinaia di migliaia di token di codice sorgente ora raggiungeranno il limite prima.

Perché la lunghezza del contesto è importante per gli agenti di codifica

Per un agente di codifica come Codex, la finestra di contesto non è una metrica di vanità. Determina la quantità di repository che il modello può "vedere" contemporaneamente quando ragiona su un bug, genera una funzionalità o esegue il refactoring di un modulo. Un rilascio di 100.000 token significa circa 75.000 parole in meno di codice, commenti e documentazione caricate in un singolo prompt.

In termini reali, questa può fare la differenza tra un agente che comprende un intero microservizio end-to-end e la necessità di operare con una visione parziale e troncata. Gli sviluppatori che lavorano su monorepos di grandi dimensioni o che eseguono ampie migrazioni tra file sono i più colpiti, perché le loro attività dipendono dal mantenimento simultaneo di molti file nel contesto.

Il cambiamento arriva quando gli strumenti di codifica ad agenti competono in modo aggressivo sulla quantità di contesto che possono gestire. I rivali hanno commercializzato enormi finestre di contesto come punto di vendita chiave, inquadrando la capacità di acquisire intere basi di codice come il percorso verso un’autentica ingegneria del software autonoma. Il ritiro di OpenAI riduce tale divario al livello predefinito.

Costo, qualità ed aspetti economici di un contesto a lungo termine

La motivazione probabile è il costo. Contesti più lunghi sono notevolmente più costosi da elaborare, sia in termini di calcolo che di latenza, perché il modello deve occuparsi di ogni token nell'input. Anche gli elevati tassi di fallimento "ago in un pagliaio" tendono a insinuarsi man mano che i contesti si estendono, il che significa che i modelli a volte perdono informazioni sepolte in profondità in un lungo prompt. Limitare la finestra predefinita può ridurre questi problemi di precisione riducendo al contempo la spesa per inferenza.

OpenAI non ha pubblicato un annuncio separato che spiega la riduzione. La modifica è avvenuta solo attraverso l'aggiornamento dei metadati e il backport alla linea di rilascio 0.144, che è il ramo distribuito alla maggior parte degli utenti non alpha del Codex. Questa implementazione di basso profilo è di per sé degna di nota: una decisione che influisce direttamente sulla produttività degli sviluppatori è stata comunicata tramite un codice differenziale anziché un post sul blog o un registro delle modifiche.

Per i team, l’implicazione pratica è semplice. Le attività che in precedenza rientravano in un singolo passaggio di contesto potrebbero ora richiedere la suddivisione del lavoro in blocchi più piccoli, il recupero dei file rilevanti in modo più selettivo o l'accettazione che l'agente abbia un campo visivo più ristretto. Alcuni sviluppatori potrebbero aggirare il limite affidandosi al `max_context_window` più alto, ove disponibile, anche se in genere ciò richiede una configurazione esplicita.

Uno schema più ampio di aggiustamenti silenziosi

Il taglio del contesto del Codex si adatta a un modello di settore più ampio in cui i laboratori di intelligenza artificiale ottimizzano i parametri dei loro modelli tra i lanci principali. Le dimensioni delle finestre, i limiti di velocità e i comportamenti predefiniti vengono spesso modificati tramite aggiornamenti dell'infrastruttura che non raggiungono mai un comunicato stampa. Gli sviluppatori che dipendono da questi sistemi osservano sempre più i repository sottostanti e le risposte API per i primi segnali.

La mossa di OpenAI evidenzia anche il divario tra marketing e realtà. Un modello può supportare la lunghezza del contesto del titolo, ma la finestra effettiva che i prodotti effettivamente espongono può essere considerevolmente più piccola, modellata dalle decisioni sui costi che i fornitori prendono per conto degli utenti.

Stai al passo con l'intelligenza artificiale

I parametri del modello cambiano costantemente e gli strumenti da cui dipendono gli sviluppatori possono cambiare da un giorno all'altro. Per report tempestivi su rilasci, cambiamenti di capacità e aspetti economici dell'IA di frontiera, segui le ultime notizie sull'IA su AI Buzz Wire.

Leggi altre notizie sull'AI →