OpenAI heeft de ontwikkelaarsprijzen voor zijn grensverleggende GPT-5.6 Sol-model met meer dan 20% verlaagd, meldde Reuters vrijdag, waarmee een einde kwam aan maanden van weerstand toen concurrenten de premie van het vlaggenschip weghaalden. Deze stap brengt het meest capabele model van OpenAI terug naar $4 per miljoen inputtokens en $20 per miljoen outputtokens op het standaardniveau, volgens de officiële prijspagina van het bedrijf - een aanzienlijke daling ten opzichte van de $5 input- en $30-outputtarieven die Sol sinds de lancering hanteerde. Het is het duidelijkste signaal tot nu toe dat de AI-prijzenoorlog de top van de modellenstapel heeft bereikt, een verschuiving die we hebben gevolgd in onze [verslaggeving over de economie van de AI-industrie] (https://aibuzzwire.news).
De cijfers achter de snede
De nieuwe prijzen in de platformdocumentatie van OpenAI tonen GPT-5.6 Sol voor $4,00 per miljoen invoertokens, $0,40 voor in de cache opgeslagen invoer, $5,00 voor cacheschrijfbewerkingen en $20,00 per miljoen uitvoertokens voor verzoeken met een korte context. Verzoeken met een lange context hebben nu een invoer van $ 8,00 en een uitvoer van $ 30,00. Dat vertegenwoordigt een reductie van 20% op de input en een reductie van 33% op de output vergeleken met de lanceringsprijzen van het model van $5 en $30.
OpenAI hanteert ook promotionele Sol-prijzen voor $2,00 input en $10,00 output – de helft van het nieuwe standaardtarief – waarvan het bedrijf zegt dat deze ten minste tot en met 21 november 2026 beschikbaar is. Batch- en flexniveaus dalen zelfs nog lager, beginnend bij $2,00 input en $10,00 output voor flexibele planning.
Een vlaggenschip dat stand hield - tot nu toe
De bezuiniging keert een doelbewuste strategie om. Toen OpenAI op 30 juli de prijzen voor de GPT-5.6-familie verlaagde, verlaagde het het kleine Luna-model met 80% tot $0,20 input en $1,20 output, en verlaagde het de middenklasse Terra met 20% tot $2 en $12 – maar liet Sol onaangeroerd, met het argument dat de mogelijkheden van het vlaggenschip grensprijzen rechtvaardigden.
Drie weken marktdruk lijken de calculus te hebben veranderd. Claude Opus 5 van Anthropic biedt een input van $ 5 en een output van $ 25, wat Sol's oude output van $ 30 ondermijnt, terwijl Claude Sonnet 5 beschikbaar is met een introductie van $ 2 input en $ 10 output tot en met 31 augustus voordat hij overgaat naar $ 3 en $ 15. Chinese laboratoria ondermijnen beide: DeepSeek's V4 Pro 0813 wordt genoteerd voor ongeveer $ 0,435 input en $ 0,87 output per miljoen tokens via routeringsplatforms, en Moonshot AI's Kimi K3 voor $ 2,80 en $ 14.
Ontwikkelaarsroute, ze trouwen niet
Voor technische teams is de prijsstelling van modellen een routeringsbeslissing geworden. Een typische enterprise-stack kan het moeilijkste codeer- en redeneerwerk naar een grensmodel sturen, routinetaken naar een middenlaag en repetitieve taken met grote volumes naar de goedkoopste optie. Wanneer de outputtokens van het vlaggenschip 30x meer kosten dan die van een geloofwaardige rivaal, beginnen financiële teams zich af te vragen welke verzoeken echt de premie verdienen.
De gedragsverandering is al zichtbaar. Fortune meldde in juli dat Andy Fang, mede-oprichter en CTO van DoorDash, zei dat Moonshot AI "betere kwaliteit" bood tegen "goedkopere kosten" voor een van de AI-experimenten van het bedrijf, en dat Airbnb en Siemens Chinese providers, waaronder Alibaba en DeepSeek, aan het testen waren toen de AI-rekeningen explosief toenamen.
Reuters koppelde de bezuiniging van vrijdag aan die concurrentiedruk en merkte op dat OpenAI eraan werkt om ontwikkelaars aan zijn platform te verankeren terwijl rivalen – waaronder Anthropic, dat een blockbuster IPO voorbereidt – vanuit alle richtingen persen. OpenAI passeerde eerder deze zomer een miljard gebruikers na de prijsverlagingen in juli, en het bedrijf heeft betoogd dat inferentiekosten nu productstrategie zijn in plaats van back-office-loodgieterswerk, waarbij betere hardwareroutering, verbeterde inferentiesoftware en slimmere contextcaching worden toegeschreven aan het vermogen om tarieven te verlagen.
Wat het betekent voor de markt
Voor OpenAI beschermt de Sol-cut de gracht waar deze het dunst is: workloads van ontwikkelaars die tussen API's kunnen bewegen met een configuratiewijziging. De promotielaag tot en met november leest als een agressieve retentietool gericht op de evaluatiecyclus die bedrijven doorlopen voordat ze productieverkeer vastleggen.
Voor de bredere markt geven een concurrent van minder dan $ 1, een mid-frontier-optie van $ 14 en een vlaggenschip van $ 20 aan dat de symbolische prijzen sneller dalen dan de meeste voorspellingen voor 2025 hadden verwacht – zelfs nu de trainingskosten voor frontier-modellen enorm stijgen. Labs subsidiëren in feite gevolgtrekkingen om het ecosysteemaandeel te verdedigen, een dynamiek die de voorkeur geeft aan de bedrijven met de diepste zakken en de grootste distributie.
De reactie van Anthropic zal nauwlettend in de gaten worden gehouden. Met de beursintroductie gericht op een verhoging van maximaal $ 100 miljard, volgens The New York Times, heeft het bedrijf alle prikkels om zijn prijsvoordeel zichtbaar te houden. Google, Meta en de Chinese laboratoria hebben elk hun eigen bezuinigingen waarmee rekening moet worden gehouden.
Voor ontwikkelaars is het advies eenvoudig: de prijzen veranderen wekelijks en de factuur die u vorige maand hebt begroot, is al verouderd. Het vastleggen van architectuur rond de tariefkaart van één enkele leverancier is nu een risico op zichzelf: routeringslagen die verkeer tussen modellen kunnen verschuiven als de prijzen veranderen, zijn een standaardinfrastructuur geworden, een trend die werd versneld door Stripe's overname van OpenRouter deze week.
Blijf AI een stap voor
Modelprijzen, releases en benchmarkoorlogen bewegen zich in een razend tempo. AI Buzz Wire levert dagelijks brongeverifieerd AI-nieuws: nauwkeurige cijfers, echte bronnen, geen hype.
Lees meer AI-modelnieuws →