OpenAI obniżyło ceny dla deweloperów swojego pionierskiego modelu GPT-5.6 Sol o ponad 20%, podał w piątek Reuters, kończąc miesiące oporu, gdy konkurenci obcinali cenę flagowca. Jak wynika z oficjalnej strony z cenami firmy, to posunięcie powoduje obniżenie najbardziej wydajnego modelu OpenAI do 4 dolarów za milion tokenów wejściowych i 20 dolarów za milion tokenów wyjściowych na warstwie standardowej – co stanowi znaczący spadek w porównaniu ze stawkami wejściowymi wynoszącymi 5 dolarów i 30 dolarów wyjściowymi, które Sol oferował od czasu premiery. To jak dotąd najwyraźniejszy sygnał, że wojna cenowa dotycząca sztucznej inteligencji osiągnęła szczyt stosu modeli, co śledzimy w naszych reportażach z ekonomii branży sztucznej inteligencji.
Liczby za cięciem
Nowe ceny podane w dokumentacji platformy OpenAI pokazują, że GPT-5.6 Sol wynosi 4,00 USD za milion tokenów wejściowych, 0,40 USD za dane wejściowe w pamięci podręcznej, 5,00 USD za zapisy w pamięci podręcznej i 20,00 USD za milion tokenów wyjściowych w przypadku żądań o krótkim kontekście. Żądania o długim kontekście mają teraz wartość wejściową wynoszącą 8,00 USD i wyjściową 30,00 USD. Oznacza to 20% redukcję nakładów i 33% redukcję produkcji w porównaniu z cenami początkowymi modelu wynoszącymi 5 i 30 dolarów.
OpenAI oferuje również promocyjne ceny Sol wynoszące 2,00 USD na wejściu i 10,00 USD na wyjściu – czyli połowę nowej stawki standardowej – która według firmy będzie dostępna co najmniej do 21 listopada 2026 r. Poziomy wsadowe i elastyczne spadają jeszcze niżej, zaczynając od 2,00 USD wejścia i 10,00 USD wyjścia, co zapewnia elastyczne planowanie.
Okręt flagowy, który przetrwał — aż do teraz
Cięcie odwraca przemyślaną strategię. Kiedy 30 lipca OpenAI obniżyło ceny całej rodziny GPT-5.6, obniżyło ceny małego modelu Luna o 80% do 0,20 USD nakładów i 1,20 USD produkcji, a średniej klasy Terra o 20% do 2 i 12 USD — ale pozostawiło Sola nietkniętego, argumentując, że możliwości flagowca uzasadniają graniczne ceny.
Wydaje się, że trzy tygodnie presji rynkowej zmieniły kalkulację. Claude Opus 5 firmy Anthropic osiąga cenę wejściową 5 USD i produkcję wyjściową 25 USD, podcinając dawną stawkę wyjściową Sol wynoszącą 30 USD, podczas gdy Claude Sonnet 5 będzie dostępny przy wstępnym wkładzie wejściowym 2 USD i wyjściu 10 USD do 31 sierpnia, po czym zostanie przeniesiony do 3 i 15 USD. Chińskie laboratoria podcięły oba rozwiązania: V4 Pro 0813 firmy DeepSeek kosztuje około 0,435 USD i 0,87 USD na milion tokenów przesłanych przez platformy routingu, a Kimi K3 firmy Moonshot AI kosztuje 2,80 i 14 USD.
Droga programistów, nie żenią się
Dla zespołów inżynierskich wycena modelu stała się decyzją o wyborze trasy. Typowy stos korporacyjny może wysyłać najcięższe prace związane z kodowaniem i wnioskowaniem do modelu granicznego, rutynowe zadania do modelu średniego poziomu, a powtarzalne zadania o dużej liczbie powtórzeń do najtańszej, wydajnej opcji. Kiedy tokeny wyjściowe produktu flagowego kosztują 30 razy więcej niż produkty wiarygodnego rywala, zespoły finansowe zaczynają pytać, które żądania naprawdę zasługują na premię.
Zmiana zachowania jest już widoczna. W lipcu magazyn Fortune podał, że współzałożyciel DoorDash i dyrektor ds. technicznych, Andy Fang, powiedział, że sztuczna inteligencja Moonshot oferuje „lepszą jakość” za „niższy koszt” w przypadku jednego z eksperymentów sztucznej inteligencji firmy oraz że Airbnb i Siemens testują chińskich dostawców, w tym Alibaba i DeepSeek, w miarę wzrostu rachunków za sztuczną inteligencję.
Reuters powiązał piątkową obniżkę z tą presją konkurencyjną, zauważając, że OpenAI pracuje nad tym, aby programiści byli zakotwiczeni na swojej platformie, podczas gdy rywale – w tym Anthropic, która przygotowuje hitowe IPO – naciskają ze wszystkich stron. Na początku tego lata, po lipcowych obniżkach cen, OpenAI przekroczyło miliard użytkowników, a firma argumentowała, że koszt wnioskowania jest obecnie strategią produktu, a nie instalacją zaplecza, przypisując lepszemu routingowi sprzętu, ulepszonemu oprogramowaniu do wnioskowania i inteligentniejszemu buforowaniu kontekstu za jego zdolność do zmniejszania szybkości.
Co to oznacza dla rynku
W przypadku OpenAI cięcie Sol chroni fosę tam, gdzie jest najcieńsza: obciążenia programistów, które mogą przenosić się między interfejsami API po zmianie konfiguracji. Poziom promocyjny do listopada można odczytać jako agresywne narzędzie retencji, ukierunkowane na cykl oceny przeprowadzany przez przedsiębiorstwa przed zatwierdzeniem ruchu produkcyjnego.
Dla szerszego rynku konkurent za mniej niż 1 dolara, opcja mid-frontier za 14 dolarów i obecnie flagowy sygnał za 20 dolarów, że ceny tokenów spadają szybciej niż większość przewidywań na 2025 rok – nawet gdy koszty szkoleń dla modeli frontierowych rosną. Laboratoria skutecznie dotują wnioskowanie, aby chronić udział w ekosystemie, co jest dynamiką faworyzującą firmy z najgłębszymi kieszeniami i największą dystrybucją.
Reakcja Anthropic będzie uważnie obserwowana. Według „The New York Times” spółka ma wszelkie bodźce, aby utrzymać widoczną przewagę cenową, gdyż jej oferta publiczna ma na celu podniesienie kwoty do 100 miliardów dolarów. Google, Meta i chińskie laboratoria mają własne rozwiązania do rozważenia.
Dla programistów rada jest prosta: ceny zmieniają się co tydzień, a faktura, którą zaplanowałeś w zeszłym miesiącu, jest już nieaktualna. Zablokowanie architektury wokół arkusza stawek jednego dostawcy jest obecnie ryzykiem samym w sobie — warstwy routingu, które mogą przesuwać ruch między modelami w miarę zmiany cen, stały się standardową infrastrukturą, a trend ten przyspieszył przejęcie OpenRouter przez Stripe w tym tygodniu.
Wyprzedź sztuczną inteligencję
Ceny modeli, premiery i wojny o benchmarki toczą się z zawrotną szybkością. AI Buzz Wire codziennie dostarcza wiadomości o AI zweryfikowane pod kątem źródła — dokładne liczby, prawdziwe źródła, zero szumu.
Przeczytaj więcej aktualności na temat modeli AI →