OpenAI po cichu zmniejszyło robocze okno kontekstowe dla swojego agenta kodującego Codex i podstawowej rodziny modeli GPT-5.6, zmniejszając użyteczny limit z około 372 000 tokenów do 272 000 tokenów. Zmiana, ujawniona w wyniku połączonego żądania ściągnięcia w repozytorium Codexu o otwartym kodzie źródłowym, wywołała ostrą reakcję programistów, którzy polegają na dużych kontekstach do analizowania całych baz kodu w jednym przebiegu.

Korekta odzwierciedla znane napięcia w branży sztucznej inteligencji, gdzie firmy równoważą koszt wnioskowania w długim kontekście z wygodą, jaką zapewnia użytkownikom. W najnowszym doniesieniu o branży AI to posunięcie podkreśla, jak nawet niewielkie zmiany w metadanych modelu mogą mieć wpływ na miliony przepływów pracy programistów.

Co się zmieniło i gdzie to zauważono

Redukcja stała się widoczna w pliku metadanych modelu dołączonym do repozytorium Codex, `codex-rs/models-manager/models.json`. Żądanie ściągnięcia zatytułowane „Backport odświeżył metadane modelu pakietu do wersji 0,144”, którego autorem jest inżynier OpenAI sayan-oai i połączone 18 lipca 2026 r., odświeżyło metadane używane przez stabilnych klientów Codex do zrozumienia możliwości każdego modelu.

Bieżący plik pokazuje wartość `context_window` wynoszącą 272 000 tokenów w całej gamie GPT-5.6, w tym wariantach GPT-5.6-Sol, GPT-5.6-Terra i GPT-5.6-Luna, a także starsze wpisy GPT-5.5 i GPT-5.2. Według dyskusji w Hacker News, gdzie zmiana uzyskała ponad 350 głosów „za”, wcześniej działający limit wynosił około 372 000 tokenów. Niektóre modele zachowują wyższe „max_context_window” wynoszące do jednego miliona tokenów, ale domyślne okno, o które faktycznie proszą klienci, jest obecnie ograniczone do 272 000.

To rozróżnienie ma znaczenie. Maksymalne okno kontekstu reprezentuje to, co model teoretycznie mógłby zaakceptować, podczas gdy działające „okno_kontekstu” jest tym, co klient Codexu jest domyślnie skonfigurowany do wysyłania. W praktyce oznacza to, że programiści, którzy wcześniej zasilali agenta setkami tysięcy tokenów kodu źródłowego, teraz szybciej osiągną sufit.

Dlaczego długość kontekstu ma znaczenie dla agentów kodujących

Dla agenta kodującego, takiego jak Codex, okno kontekstowe nie jest miernikiem próżności. Określa, jaką część repozytorium model może „zobaczyć” na raz podczas rozpatrywania błędu, generowania funkcji lub refaktoryzacji modułu. Upuszczenie 100 000 tokenów oznacza mniej więcej 75 000 słów kodu, komentarzy i dokumentacji załadowanych w jednym znaku zachęty.

W świecie rzeczywistym może to stanowić różnicę między agentem rozumiejącym kompleksowo całą mikrousługę a koniecznością działania z częściowym, skróconym widokiem. Najbardziej dotknięci są programiści pracujący na dużych repozytoriach mono lub przeprowadzający rozległe migracje między plikami, ponieważ ich zadania zależą od jednoczesnego przechowywania wielu plików w kontekście.

Zmiana pojawia się, gdy narzędzia kodowania agentowego agresywnie konkurują o to, ile kontekstu mogą obsłużyć. Rywale reklamowali ogromne okna kontekstowe jako kluczowy punkt sprzedaży, traktując możliwość przyjmowania całych baz kodu jako ścieżkę do prawdziwej autonomicznej inżynierii oprogramowania. Wycofanie się OpenAI zawęża tę lukę na poziomie domyślnym.

Koszt, jakość i ekonomia w długim kontekście

Prawdopodobną motywacją są koszty. Dłuższe konteksty są znacznie droższe w przetwarzaniu, zarówno pod względem obliczeń, jak i opóźnień, ponieważ model musi obsługiwać każdy token na danych wejściowych. Wysokie wskaźniki awaryjności typu „igła w stogu siana” również mają tendencję do wkradania się w miarę rozciągania kontekstu, co oznacza, że ​​w modelach czasami brakuje informacji ukrytych głęboko w długim podpowiedzi. Ograniczenie okna domyślnego może zmniejszyć te problemy z dokładnością, jednocześnie ograniczając wydatki na wnioskowanie.

OpenAI nie opublikowało osobnego komunikatu wyjaśniającego obniżkę. Zmiana nastąpiła jedynie poprzez odświeżenie metadanych i przeniesienie do wersji 0.144, która jest gałęzią dostarczaną większości użytkowników Kodeksu innych niż alfa. To skromne wdrożenie samo w sobie jest godne uwagi: decyzja, która bezpośrednio wpływa na produktywność programistów, została przekazana poprzez różnicę w kodzie, a nie poprzez post na blogu lub dziennik zmian.

W przypadku zespołów praktyczne konsekwencje są proste. Zadania, które wcześniej mieściły się w ramach jednego kontekstu, mogą teraz wymagać podziału pracy na mniejsze części, bardziej selektywnego pobierania odpowiednich plików lub zaakceptowania faktu, że agent ma węższe pole widzenia. Niektórzy programiści mogą ominąć ten limit, opierając się na wyższym `max_context_window`, jeśli jest dostępny, choć zazwyczaj wymaga to jawnej konfiguracji.

Szerszy wzór cichych regulacji

Kontekst Kodeksu pasuje do szerszego wzorca branżowego, w którym laboratoria sztucznej inteligencji dostosowują parametry swoich modeli pomiędzy głównymi premierami. Rozmiary okien, limity prędkości i domyślne zachowania są często dostosowywane poprzez aktualizacje infrastruktury, które nigdy nie trafiają do komunikatu prasowego. Programiści, którzy polegają na tych systemach, coraz częściej obserwują podstawowe repozytoria i odpowiedzi API pod kątem wczesnych sygnałów.

Posunięcie OpenAI uwydatnia także przepaść pomiędzy marketingiem a rzeczywistością. Model może obsługiwać długość kontekstu nagłówka, ale efektywne okno, które faktycznie eksponują produkty, może być znacznie mniejsze, kształtowane na podstawie decyzji dotyczących kosztów podejmowanych przez dostawców w imieniu użytkowników.

Wyprzedź sztuczną inteligencję

Parametry modelu stale się zmieniają, a narzędzia, na których polegają programiści, mogą zmienić się z dnia na dzień. Aby otrzymywać aktualne raporty na temat wydań, zmian w możliwościach i ekonomii pionierskiej sztucznej inteligencji, śledź najświeższe wiadomości dotyczące sztucznej inteligencji w AI Buzz Wire.

Przeczytaj więcej aktualności o sztucznej inteligencji →