Co się zmieniło
Zgodnie z opublikowanym arkuszem stawek i dziennikiem zmian API OpenAI, standardowe ceny za milion tokenów brzmią obecnie:
– GPT-5.6 Luna: 20 centów na wejściu i 1,20 dolara na wyjściu, w porównaniu z 1 i 6 dolarami – 80% zniżki
– GPT-5.6 Terra: 2 i 12 dolarów, w porównaniu z 2,50 i 15 dolarów – obniżka o 20%
- GPT-5.6 Sol (okręt flagowy): 5 i 30 dolarów, bez zmian
Wszystkie trzy poziomy zostały wprowadzone do ogólnej dostępności 9 lipca 2026 r. po wyższych stawkach, co oznacza, że zmiana wyceny nastąpi zaledwie 21 dni od rozpoczęcia komercyjnego życia rodziny. Zarówno Reuters, jak i CNBC potwierdziły obniżki, a Axios podał, że najbardziej radykalna obniżka przypadła na model Luna.
Ogranicza przepływ na każdym poziomie usług
Obniżki nie ograniczają się do cen głównych. Przechodzą przez każdą opcję w arkuszu stawek:
- Przetwarzanie wsadowe i elastyczne, oba o połowę niższe od ceny standardowej, dają Lunie 10 centów wejściowych i 60 centów wyjściowych za milion tokenów.
- Odczyty danych wejściowych z pamięci podręcznej, zniżka 90%, spadek do dwóch centów za milion tokenów na Lunie i 20 centów na Terra.
- Żądania o długim kontekście, rozliczane według podwójnej stawki wejściowej i 1,5-krotności wyjściowej, wynoszą 40 centów i 1,80 dolara w przypadku Luny.
W przypadku zespołów, które już korzystają z klasyfikacji zbiorczej, ekstrakcji lub długich pętli agentów na niższych poziomach, te same połączenia kosztują teraz ułamek tego, co dzień wcześniej.
Porównanie cięć z Anthropic
Według strony cenowej Anthropic, przy cenie 20 centów i cenie 1,20 dolara, Luna podcina obecnie najtańszy opublikowany model Anthropic, Haiku 4.5, około pięciokrotnie w zakresie nakładów i czterokrotnie przychodów. Nowa stawka Terra jest niższa od 3 i 15 dolarów, które Claude Sonnet 5 ma pobierać po wygaśnięciu początkowej ceny 31 sierpnia 2026 r.
Na szczycie obu zestawień Sol nadal kosztuje więcej niż Opus 5 firmy Anthropic, którego cena wynosi 5 i 25 dolarów.
Przetwarzanie priorytetowe staje się trybem szybkim
W tym samym wpisie dziennika zmian wycofano „Przetwarzanie priorytetowe” i zastąpiono je „Trybem szybkim”. Według OpenAI w przypadku flagowego modelu Sol tryb szybki działa do 2,5 razy szybciej niż w przypadku standardowej prędkości za dwukrotnie wyższą cenę, a przełącznik jest kompatybilny wstecz — żądania są już oznaczone jako priorytetowe kierowanie do trybu szybkiego bez zmiany kodu.
Stawki w trybie szybkim wynoszą 10 i 60 dolarów za Sol, 4 dolarów i 24 dolarów za Terra oraz 40 centów i 2,40 dolara za Lunę. Warto zauważyć, że Anthropic sprzedaje ten sam produkt pod tą samą nazwą i na tych samych warunkach, a oba arkusze stawek są teraz zbieżne w oparciu o wnioskowanie przypisane do regionu: OpenAI pobiera 10% podwyżkę w przypadku modeli wydanych 5 marca 2026 r. lub później, gdy klient wymaga przechowywania danych, podczas gdy Anthropic wystawia rachunki za wnioskowanie wyłącznie w USA według stawki 1,1-krotności standardowej.
Dlaczego tańsze poziomy stały się tańsze
Dzień przed cięciem OpenAI opublikowało post inżynieryjny opisujący optymalizacje w całym stosie wnioskowania. Pięciu członków personelu technicznego firmy napisało, że Sol, działając w narzędziu kodującym Codex, przepisał produkcyjne jądra GPU — według OpenAI prace obniżyły koszty kompleksowej obsługi o 20%. W ramach modelu przeprojektowano także własny projekt modelu dekodowania spekulatywnego na podstawie setek eksperymentów, co przypisuje się zwiększeniu wydajności generowania tokenów o ponad 15%.
Są to własne dane OpenAI dotyczące jego własnego stosu, ale wskazują na to samo centrum kosztów, do którego odnoszą się obniżki cen: wiązkę agentów stojącą za Codexem i ChatGPT. OpenAI domyślnie ogranicza dane wyjściowe narzędzia do 10 000 tokenów i przechowuje historię widoczną dla modelu tylko do dołączania, więc pętla agenta, która ponownie wysyła swoje instrukcje na każdym kroku, trafia do pamięci podręcznej podpowiedzi, zamiast płacić pełne stawki wejściowe. Firma zamknęła post, zobowiązując się do przekazania „ulepszeń ukrytych pod maską naszym użytkownikom w postaci szerzej dostępnych, opłacalnych informacji wywiadowczych”. Arkusz stawek pojawił się dzień później.
Partnerzy w chmurze i rozliczenia
OpenAI zauważyło, że kupujący kierujący ruchem przez Amazon Bedrock są rozliczani przez AWS, a stawki te mogą różnić się od opublikowanych przez tę kartę. W miarę jak coraz więcej przedsiębiorstw centralizuje dostęp do modeli za pośrednictwem jednego dostawcy usług w chmurze, różnica między bezpośrednimi cenami OpenAI a tym, co klienci faktycznie płacą za pośrednictwem pośredników, będzie miała takie samo znaczenie jak same nagłówki.
Rynek liczący każdy żeton
Cięcia nastąpią, gdy nabywcy przedsiębiorstw kontrolują wydatki wnioskowane dokładniej niż kiedykolwiek. Na początku tygodnia w raportach udokumentowano, jak era niepohamowanego „tokenmaxxingu” – zwiększania wolumenu bez oglądania się na koszty – dobiega końca wraz ze wzrostem rachunków korporacyjnych za sztuczną inteligencję na głównych platformach. Decyzja OpenAI o przekazaniu oszczędności w kosztach wewnętrznych klientom, a nie gromadzeniu marży, jest wyraźnym sygnałem tego, gdzie według niej toczy się obecnie walka konkurencyjna: nie na granicy, gdzie Sol nadal oferuje najwyższe ceny, ale na tanich, wysokonakładowych poziomach, na których faktycznie odbywa się większość ruchu produkcyjnego.
Przy niezmienionej cenie Sol decyzja deweloperów pozostaje dokładnie taka, jaką postawiła OpenAI od czasu dostarczenia rodziny rozwiązań: jakiego poziomu wymaga każde żądanie. Różnica polega na tym, że koszt podjęcia błędnej decyzji właśnie drastycznie spadł.
---
Wyprzedź sztuczną inteligencjęOtrzymuj najnowsze wiadomości, analizy i przełomowe informacje dotyczące sztucznej inteligencji — wszystko w jednym miejscu.
Przeczytaj więcej aktualności o sztucznej inteligencji →