OpenAI sänkte API-priserna på två av sina tre GPT-5.6-modeller den 30 juli 2026, vilket minskade den billigaste nivån med 80 % knappt tre veckor efter att familjen nått allmän tillgänglighet. Flytten signalerar hur aggressivt den ledande modelltillverkaren tävlar om höga volymer, kostnadskänsliga arbetsbelastningar – och hur noga dess kunder nu räknar varje token. För mer om det bredare skiftet inom AI-ekonomi, följ vår senaste AI-utvecklingen.

Vad förändrades

Enligt OpenAI:s publicerade priskort och API-ändringslogg lyder standardpriserna per miljon token nu:

  • GPT-5,6 Luna: 20 cents ingång och 1,20 $ utmatning, en minskning från 1 $ och 6 $ - en 80 % minskning
  • GPT-5,6 Terra: 2 $ och 12 $, ned från 2,50 $ och 15 $ - en minskning med 20 %
  • GPT-5.6 Sol (flaggskeppet): $5 och $30, oförändrat

Alla tre nivåerna lanserades till allmän tillgänglighet den 9 juli 2026 till de högre priserna, vilket placerar omprissättningen bara 21 dagar in i familjens kommersiella liv. Reuters och CNBC bekräftade båda nedskärningarna, och Axios rapporterade att den brantaste minskningen föll på Luna-modellen.

Nedskärningar flödar genom varje servicenivå

Sänkningarna är inte begränsade till rubrikpriser. De går igenom alla alternativ på prislistan:

  • Batch- och Flex-bearbetning, båda halva standardpriset, ger Luna 10 cents input och 60 cents output per miljon tokens.
  • Cachad indata läser, rabatterad 90 %, sjunk till två cent per miljon tokens på Luna och 20 cent på Terra.
  • Långsammanhangsbegäranden, faktureras med dubbla inmatningshastigheten och 1,5 gånger utmatningen, landar på 40 cent och $1,80 för Luna.

För lag som redan dirigerar bulkklassificering, extraktion eller långa agentslingor genom de billigare nivåerna, kostar samma samtal nu en bråkdel av vad de gjorde en dag tidigare.

Hur snitten jämför med Anthropic

Med 20 cent in och 1,20 $ ut underskrider Luna nu Anthropics billigaste publicerade modell, Haiku 4.5, med ungefär fem gånger på input och fyra gånger på output, enligt Anthropics prissida. Terras nya kurs ligger under $3 och $15 som Claude Sonnet 5 är planerad att ta ut när dess introduktionspris upphör den 31 augusti 2026.

I toppen av båda laguppställningarna kostar Sol fortfarande mer på produktion än Anthropics Opus 5, som är prissatt till $5 och $25.

Prioriterad bearbetning blir snabbläge

Samma ändringsloggpost tog bort "Prioritetsbearbetning" och ersatte den med "Snabbläge." För flaggskeppet Sol-modellen säger OpenAI att snabbläget går upp till 2,5 gånger standardhastigheten till dubbla priset, och omkopplaren är bakåtkompatibel – förfrågningar som redan är taggade för prioriterad väg till snabbläge utan kodändring.

Priserna i snabbläge är $10 och $60 för Sol, $4 och $24 för Terra, och 40 cent och $2,40 för Luna. Noterbart är att Anthropic säljer samma produkt under samma namn och samma villkor, och de två priskorten konvergerar nu också på regionanpassade slutsatser: OpenAI tar ut en höjning på 10 % på modeller som släpptes den 5 mars 2026 eller senare när en kund kräver datauppehållstillstånd, medan Anthropic fakturerar enbart USA-slutsatsen till 11 gånger standardpriset.

Varför de billigare nivåerna blev billigare

En dag före klippet publicerade OpenAI ett tekniskt inlägg som beskrev optimeringar över dess slutledningsstack. Fem medlemmar av företagets tekniska personal skrev att Sol, som kördes i sitt Codex-kodningsverktyg, skrev om produktions-GPU-kärnor - enligt OpenAI minskade de totala serveringskostnaderna med 20 %. Modellen gjorde också om sin egen spekulativa avkodningsmodell över hundratals experiment, en förändring som krediteras med att öka effektiviteten i tokengenereringen med mer än 15 %.

Det är OpenAIs egna siffror för sin egen stack, men de pekar på samma kostnadsställe som prissänkningsadresserna adresserar: agenten bakom Codex och ChatGPT. OpenAI begränsar verktygsutmatningen till 10 000 tokens som standard och behåller modellens synlig historik endast tillägg, så en agentslinga som skickar om sina instruktioner vid varje steg träffar promptcachen istället för att betala full inmatningshastighet. Företaget avslutade inlägget med ett åtagande att skicka "under-huven förbättringar tillbaka till våra användare i form av mer allmänt tillgänglig, kostnadseffektiv intelligens." Priskortet följde en dag senare.

Molnpartners och fakturering

OpenAI noterade att köpare som dirigerar trafik genom Amazon Bedrock faktureras av AWS, och dessa priser kan skilja sig från dess eget publicerade kort. När fler företag centraliserar modellåtkomst genom en enda molnleverantör kommer klyftan mellan OpenAI:s direkta prissättning och vad kunder faktiskt betalar via mellanhänder att ha lika stor betydelse som själva rubriksiffrorna.

En marknad som räknar varje token

Nedskärningarna landar när företagsköpare granskar slutsatser spenderar mer noggrant än någonsin. Tidigare i veckan dokumenterade rapporter hur eran av ohämmad "tokenmaxxing" – att öka volymen utan att se kostnaden – bleknar när företagens AI-räkningar ökar över stora plattformar. OpenAI:s beslut att föra över sina interna kostnadsbesparingar till kunderna, snarare än att lägga marginalen, är en tydlig signal om var man tror att konkurrensstriden nu utkämpas: inte vid gränsen, där Sol fortfarande har premiumpriser, utan på de billiga, högvolymnivåer där den mesta produktionstrafiken faktiskt lever.

Med Sols pris oförändrat, förblir livebeslutet för utvecklare exakt där OpenAI har lagt det sedan familjen skickades: vilken nivå varje begäran kräver. Skillnaden är att kostnaden för att få det beslutet fel just har sjunkit dramatiskt.

---

Stay ahead of AI

Få de senaste AI-nyheterna, analyserna och genombrotten – allt på ett ställe.

Läs mer AI-nyheter →