OpenAI heeft de prijzen verlaagd voor twee van zijn GPT-5.6 AI-modellen, waardoor de kosten van kleinere modellen met maar liefst 80 procent zijn verlaagd, omdat bedrijven steeds gevoeliger worden voor hun rekeningen voor kunstmatige intelligentie. De verlagingen, aangekondigd op 31 juli 2026 en gedetailleerd in een bedrijfsblogpost met de titel "Advancing the Price-Performance Frontier with GPT-5.6", markeren een van de steilste prijsbewegingen van een frontier-lab-aanbieder dit jaar.

De bezuinigingen zijn gericht op de kleinere modellen met een hoog volume van OpenAI – waaronder Luna, waarvan de prijzen volgens Axios specifiek zijn verlaagd – waardoor ze worden gepositioneerd voor kostengevoelige, grootschalige workloads waarbij elke fractie van een cent per token leidt tot aanzienlijke bedrijfskosten. Voor het voortdurend volgen van de prijsoorlogen die de AI-industrie opnieuw vormgeven, volgt u ons breaking AI news.

Prijsdruk van alle kanten

De reducties vinden plaats tegen de achtergrond van toenemende frustratie bij bedrijven over AI-kosten. Zoals Reuters meldde, houden bedrijven steeds meer toezicht op wat ze uitgeven aan AI, nu de implementatie van proefprojecten overgaat naar productie op grote schaal. CNBC merkte op dat de bezuinigingen komen ‘naarmate bedrijven gevoeliger worden voor de kosten’, terwijl AI Business de stap omschrijft als een directe reactie op ‘de zorgen van bedrijven over AI-uitgaven’.

OpenAI heeft de beslissing anders geformuleerd. De blog van het bedrijf beschreef de bezuinigingen als een poging om de ‘prijs-prestatiegrens’ te verleggen – een afkorting van de branche voor de afweging tussen wat een AI-model kost om te draaien en hoe capabel het is. Door de prijs van capabele kleinere modellen te verlagen, betoogt OpenAI feitelijk dat hoogwaardige inferentie goedkoop genoeg kan worden om grootschalige toepassingen te ondersteunen die voorheen oneconomisch waren.

PYMNTS rapporteerde dat het doel is "om grote hoeveelheden werk economisch te maken", wat suggereert dat OpenAI ontwikkelaars het hof maakt bij het bouwen van applicaties die enorme aantallen API-oproepen genereren - geautomatiseerde klantenservice, pijplijnen voor het genereren van inhoud en grootschalige dataverwerkingsworkflows.

Waarom kleinere modellen belangrijk zijn

De modellen waarop de bezuinigingen betrekking hebben, zijn niet de krachtigste systemen van OpenAI, maar de lichtere, snellere varianten ervan – de werkpaarden die het grootste deel van het echte API-verkeer aandrijven. Frontier-modellen zoals de volledige GPT-5.6 blijven relatief duur, gereserveerd voor taken die een maximaal redeneervermogen vereisen. Kleinere modellen zoals Luna behandelen de lange staart van routinevragen waarbij snelheid en kosten belangrijker zijn dan maximale intelligentie.

Het verlagen van de prijs met wel 80 procent, zoals Türkiye Today meldde, zou de eenheidseconomie voor duizenden ontwikkelaars kunnen hervormen. Een applicatie die miljoenen zoekopdrachten per maand verwerkt, kan de gevolgrekening met honderdduizenden dollars zien dalen als de kosten per token zo scherp dalen: het verschil tussen een product dat bij elk gesprek geld verliest en een product dat winst maakt.

Een competitieve inferentiemarkt

De stap van OpenAI weerspiegelt de toenemende concurrentie op de inferentiemarkt. Open-gewicht en goedkopere alternatieven van aanbieders als Meta, Mistral en Chinese laboratoria zoals DeepSeek en Alibaba's Qwen-familie hebben de premie die eigen grensaanbieders kunnen vragen voor capabele maar niet-grensoverschrijdende modellen gestaag uitgehold. Naarmate deze alternatieven volwassener worden, staan ​​bedrijven als OpenAI voor de keuze: hoge prijzen verdedigen en het risico lopen volume te verliezen, of agressief bezuinigen om ontwikkelaars op hun platform te laten blijven bouwen.

De prijs-prestatieverhouding suggereert dat OpenAI voor het laatste heeft gekozen. Door zijn kleinere modellen dramatisch goedkoper te maken, gokt het bedrijf erop dat ontwikkelaars zullen blijven voortbouwen op de OpenAI-stack in plaats van te migreren naar goedkopere alternatieven – en dat het resulterende volume de lagere marge per oproep ruimschoots zal compenseren.

Het kostengesprek wordt intenser

De bezuinigingen geven ook aan dat de sector een meer financieel gedisciplineerde fase ingaat. Tijdens de eerste hausse aan generatieve AI behandelden veel bedrijven de uitgaven voor AI als een experimentele begrotingslijn, die bereid was hoge kosten op zich te nemen bij het nastreven van capaciteiten en nieuwigheden. Nu de implementaties volwassener zijn geworden, zijn hoofdinformatiefunctionarissen en financiële teams begonnen met het eisen van duidelijke rendementen op investeringen, en lijkt het tijdperk van onkritische AI-uitgaven ten einde te komen.

Industrieanalyses hebben deze verschuiving van de afgelopen maanden gedocumenteerd. AI Business rapporteerde op 31 juli afzonderlijk dat bedrijven “worstelen met de kosten van AI-schaal”, en benadrukte dat de kloof tussen ambitieuze AI-routekaarten en duurzame eenheidseconomie een centrale uitdaging blijft voor bedrijven die deze technologie adopteren.

Wat het betekent voor ontwikkelaars

Voor het ontwikkelaarsecosysteem zijn goedkopere kleinere modellen ondubbelzinnig goed nieuws. Lagere inferentiekosten vergroten het bereik van levensvatbare toepassingen, moedigen experimenten aan en verlagen de toetredingsdrempel voor startups die het zich niet kunnen veroorloven dure API-aanroepen te subsidiëren. De vraag is of de rivalen van OpenAI de bezuinigingen zullen evenaren, wat een bredere prijzenoorlog zal veroorzaken die de marges op de inferentiemarkt verder zal comprimeren.

Voorlopig heeft OpenAI een grens getrokken: capabele AI hoeft geen dure AI te zijn. Of die boodschap prijsbewuste bedrijven zal overtuigen – en of het bedrijf de strategie financieel kan volhouden – zal een bepalend verhaal voor de komende maanden zijn.

Blijf AI een stap voor

Modelreleases, prijsverschuivingen en concurrentiedynamiek veranderen het AI-landschap elke week opnieuw. Maak een bladwijzer van AI Buzz Wire voor voortdurende berichtgeving over de platforms en het beleid dat de sector aandrijft.

Lees meer nieuws over AI-modellen →