Ce s-a schimbat
Conform cardului de tarife publicat de OpenAI și jurnalului de modificări API, prețurile standard per milion de token sunt acum:
- GPT-5.6 Luna: 20 de cenți de intrare și 1,20 USD de ieșire, în scădere de la 1 USD și 6 USD - o reducere de 80%
- GPT-5.6 Terra: 2 USD și 12 USD, în scădere de la 2,50 USD și 15 USD - o reducere de 20%
- GPT-5.6 Sol (nava emblematică): 5 USD și 30 USD, neschimbate
Toate cele trei niveluri au fost lansate la disponibilitate generală pe 9 iulie 2026 la tarife mai mari, plasând reprețul la doar 21 de zile din viața comercială a familiei. Ambele Reuters și CNBC au confirmat reducerile, iar Axios a raportat că cea mai mare reducere a căzut pe modelul Luna.
Reduce fluxul prin fiecare nivel de servicii
Reducerile nu se limitează la prețurile principale. Acestea curg prin fiecare opțiune de pe cardul de tarife:
- Procesarea în lot și Flex, ambele jumătate din prețul standard, pune Luna la 10 cenți de intrare și 60 de cenți de ieșire per milion de jetoane.
- Citirile de intrare în cache, cu reducere de 90%, scade la doi cenți per milion de jetoane pe Luna și 20 de cenți pe Terra.
- Solicitările în context lung, facturate la rata de intrare dublă și de 1,5 ori ieșirea, ajung la 40 de cenți și 1,80 USD pentru Luna.
Pentru echipele care direcționează deja bucle de clasificare în bloc, extracție sau agenți lungi prin nivelurile mai ieftine, aceleași apeluri costă acum o fracțiune din ceea ce făceau cu o zi mai devreme.
Cum se compară reducerile cu Anthropic
Cu 20 de cenți și 1,20 dolari scos, Luna subcotează acum cel mai ieftin model publicat de Anthropic, Haiku 4.5, de aproximativ cinci ori la intrare și de patru ori la ieșire, conform paginii de prețuri a Anthropic. Noul tarif Terra se situează sub 3 și 15 USD pe care Claude Sonnet 5 este programat să le încaseze odată ce prețul de lansare expiră pe 31 august 2026.
În fruntea ambelor linii, Sol încă costă mai mult la producție decât Opus 5 de la Anthropic, care are un preț de 5 USD și 25 USD.
Procesarea prioritară devine modul rapid
Aceeași intrare din jurnalul de modificări a retras „Priority Processing” și a înlocuit-o cu „Fast mode”. Pentru modelul emblematic Sol, OpenAI spune că modul rapid rulează de până la 2,5 ori viteza standard la dublul prețului, iar comutatorul este compatibil cu versiunea inversă - solicitări deja etichetate pentru ruta prioritară către modul rapid fără modificarea codului.
Tarifele pentru modul rapid sunt de 10 USD și 60 USD pentru Sol, 4 USD și 24 USD pentru Terra și 40 de cenți și 2,40 USD pentru Luna. În special, Anthropic vinde același produs sub același nume și aceiași termeni, iar cele două tarife converg acum și asupra inferenței fixate în regiune: OpenAI percepe o creștere de 10% pe modelele lansate pe sau după 5 martie 2026, atunci când un client solicită rezidența datelor, în timp ce Anthropic facturează doar inferența în SUA la tariful standard de 1,1 ori.
De ce nivelurile mai ieftine s-au ieftinit
Cu o zi înainte de tăiere, OpenAI a publicat o postare de inginerie care descrie optimizările stivei sale de inferență. Cinci membri ai personalului tehnic al companiei au scris că Sol, rulând în instrumentul său de codare Codex, a rescris nucleele GPU de producție - lucrarea conform căreia OpenAI a redus costurile de servire end-to-end cu 20%. De asemenea, modelul și-a reproiectat propriul model de schiță de decodare speculativă în sute de experimente, o schimbare creditată cu creșterea eficienței generării de jetoane cu peste 15%.
Acestea sunt cifrele proprii ale OpenAI pentru propriul stack, dar indică către același centru de cost adresele de reducere a prețurilor: agentul din spatele Codex și ChatGPT. OpenAI limitează outputul instrumentului la 10.000 de jetoane în mod implicit și păstrează istoricul vizibil al modelului numai pentru adăugarea, astfel încât o buclă de agent care își retrimite instrucțiunile la fiecare pas atinge memoria cache promptă în loc să plătească ratele de intrare complete. Compania a închis postarea cu angajamentul de a transmite „îmbunătățiri sub capotă înapoi utilizatorilor noștri sub formă de informații mai disponibile și mai eficiente din punct de vedere al costurilor”. Tariful a urmat o zi mai târziu.
Parteneri cloud și facturare
OpenAI a remarcat că cumpărătorii care direcționează traficul prin Amazon Bedrock sunt facturați de AWS, iar aceste tarife pot diferi de propriul card publicat. Pe măsură ce mai multe întreprinderi centralizează accesul la model printr-un singur furnizor de cloud, diferența dintre prețurile directe ale OpenAI și ceea ce plătesc de fapt clienții prin intermediari va conta la fel de mult ca și numerele de titlu în sine.
O piață care numără fiecare jeton
Reducerile ajung pe măsură ce cumpărătorii întreprinderii auditează concluziile cheltuiesc mai mult decât oricând. La începutul săptămânii, rapoartele au documentat modul în care epoca „tokenmaxxing” nelimitată – creșterea volumului fără a urmări costurile – se estompează pe măsură ce facturile corporative de inteligență artificială cresc pe platformele majore. Decizia OpenAI de a-și transfera economiile interne de costuri către clienți, mai degrabă decât să înregistreze marja, este un semnal clar despre locul în care crede că se duc acum bătălia competitivă: nu la frontieră, unde Sol încă impune prețuri premium, ci la nivelurile ieftine, cu volum mare, unde trăiește de fapt majoritatea traficului de producție.
Cu prețul Sol neschimbat, decizia live pentru dezvoltatori rămâne exact acolo unde a pus-o OpenAI de când familia a fost expediată: ce nivel necesită fiecare cerere. Diferența constă în faptul că costul unei decizii greșite tocmai a scăzut dramatic.
---
Rămâneți înaintea AIObțineți cele mai recente știri, analize și descoperiri despre AI - toate într-un singur loc.
Citiți mai multe știri AI →