OpenAI a redus prețurile la două dintre modelele sale GPT-5.6 AI, reducând costul modelelor mai mici cu până la 80%, pe măsură ce companiile devin din ce în ce mai sensibile la facturile de inteligență artificială. Reducerile, anunțate pe 31 iulie 2026 și detaliate într-o postare pe blogul companiei intitulată „Avansarea frontierei preț-performanță cu GPT-5.6”, marchează una dintre cele mai abrupte mișcări de prețuri de la un furnizor de laborator de frontieră din acest an.

Reducerile vizează modelele OpenAI mai mici, cu volum mare – inclusiv Luna, ale cărei prețuri a raportat Axios au fost reduse în mod special – poziționându-le pentru sarcini de lucru la scară mare, sensibile la costuri, în care fiecare fracțiune de un cent pe token se transformă în cheltuieli de operare semnificative. Pentru urmărirea continuă a războaielor prețurilor care remodelează industria AI, urmăriți știrile de ultimă oră AI.

Presiunea prețurilor din toate părțile

Reducerile apar pe fundalul unei frustrari crescânde a întreprinderilor cu costurile AI. După cum a raportat Reuters, companiile analizează din ce în ce mai mult ce cheltuiesc pe AI, pe măsură ce implementările trec de la proiecte-pilot la producție la scară. CNBC a remarcat că reducerile apar „pe măsură ce companiile devin sensibile la costuri”, în timp ce AI Business a încadrat mișcarea ca un răspuns direct la „preocupările întreprinderilor cu privire la cheltuielile cu inteligența artificială”.

OpenAI a încadrat decizia diferit. Blogul companiei a descris reducerile ca pe un efort de a împinge „frontiera preț-performanță” – prescurtare din industrie pentru compromisul între costul de funcționare al unui model AI și cât de capabil este. Prin scăderea prețului modelelor mai mici capabile, OpenAI susține efectiv că inferența de înaltă calitate poate deveni suficient de ieftină pentru a susține aplicațiile de volum mare care anterior erau neeconomice.

PYMNTS a raportat că scopul este „de a face munca de volum mare economică”, sugerând că OpenAI îi atrag pe dezvoltatorii care creează aplicații care generează un număr enorm de apeluri API - servicii automate pentru clienți, conducte de generare de conținut și fluxuri de lucru la scară largă de procesare a datelor.

De ce contează modelele mai mici

Modelele vizate de reduceri nu sunt cele mai puternice sisteme OpenAI, ci variantele sale mai ușoare și mai rapide – calii de bătaie care alimentează cea mai mare parte a traficului API din lumea reală. Modelele de frontieră, precum GPT-5.6 complet, rămân relativ scumpe, rezervate sarcinilor care necesită o capacitate maximă de raționament. Modelele mai mici precum Luna se ocupă de interogarile de rutină în care viteza și costurile contează mai mult decât inteligența de vârf.

Reducerea prețului acestora cu până la 80%, după cum a raportat Türkiye Today, ar putea remodela economia unității pentru mii de dezvoltatori. O aplicație care procesează milioane de interogări pe lună își poate vedea factura de inferență scăzând cu sute de mii de dolari atunci când costurile pe token scad atât de puternic - diferența dintre un produs care pierde bani la fiecare apel și unul care obține profit.

O piață competitivă a inferenței

Mișcarea OpenAI reflectă intensificarea concurenței pe piața de inferență. Alternativele deschise și cu costuri mai mici de la furnizori, inclusiv Meta, Mistral și laboratoarele chineze, cum ar fi DeepSeek și familia Qwen a lui Alibaba, au erodat în mod constant premium pe care furnizorii de frontieră proprietari o pot percepe pentru modelele capabile, dar nu de frontieră. Pe măsură ce aceste alternative se maturizează, companii precum OpenAI se confruntă cu o alegere: să apere prețurile ridicate și să riscă să piardă volumul sau să reducă agresiv pentru a reține dezvoltatorii care construiesc pe platforma lor.

Încadrarea preț-performanță sugerează că OpenAI a ales-o pe cea din urmă. Făcând modelele sale mai mici mult mai ieftine, compania pariază că dezvoltatorii vor continua să construiască pe stiva OpenAI, mai degrabă decât să migreze la alternative cu costuri mai mici - și că volumul rezultat va compensa mai mult decât marja mai mică pe apel.

Conversația privind costurile se intensifică

Reducerile semnalează, de asemenea, că industria intră într-o fază mai disciplinată financiar. În timpul boom-ului inițial generativ-AI, multe întreprinderi au tratat cheltuielile cu AI ca pe o linie bugetară experimentală, dornice să absoarbă costuri mari în căutarea capacității și a noutății. Pe măsură ce implementările s-au maturizat, ofițerii șefi de informații și echipele financiare au început să ceară rentabilitate clară a investiției, iar epoca cheltuielilor necritice pentru AI pare să scadă.

Analiza industriei a documentat această schimbare în ultimele luni. AI Business a raportat separat, pe 31 iulie, că întreprinderile „se confruntă cu costul de scară a AI”, subliniind că decalajul dintre foile de parcurs ambițioase ale AI și economia durabilă a unității rămâne o provocare centrală pentru cei care adoptă corporații.

Ce înseamnă pentru dezvoltatori

Pentru ecosistemul dezvoltatorilor, modelele mai ieftine mai mici sunt o veste fără ambiguitate bună. Costurile de inferență mai scăzute extind gama de aplicații viabile, încurajează experimentarea și reduc bariera de intrare pentru startup-urile care nu își permit să subvenționeze apelurile API costisitoare. Întrebarea este dacă rivalii OpenAI vor egala reducerile, declanșând un război mai larg al prețurilor care comprimă și mai mult marjele pe piața de inferență.

Deocamdată, OpenAI a tras o linie: AI capabilă nu trebuie să fie AI costisitoare. Indiferent dacă acel mesaj câștigă asupra întreprinderilor conștiente de costuri – și dacă compania poate susține strategia financiar – va fi o poveste definitorie a lunilor următoare.

Rămâi înaintea AI

Lansările de modele, schimbările de preț și dinamica competitivă remodelează peisajul AI în fiecare săptămână. Marcați AI Buzz Wire pentru o acoperire continuă a platformelor și politicilor care conduc industria.

Citiți mai multe știri despre modelele AI →