DeepSeek har uppdaterat sin API-serie med en ny flaggskeppsmodell, V4 Pro, samtidigt som de kraftigt höjt priserna över sin plattform – en avgörande vändning bort från den bottenprisstrategi som gjorde det kinesiska labbet berömt och tvingade rivaler in i ett priskrig. För en bransch som har spårat varje DeepSeek-prissänkning som en händelse som rör sig på marknaden, är vändningen lika betydande. Följ vår AI-nyhet för det senaste på modellmarknaden.

Företagets officiella API-dokumentation, uppdaterad den här veckan, listar nu två modeller: deepseek-v4-flash, som kör DeepSeek-V4-Flash-0731-versionen och deepseek-v4-pro, som kör den nya DeepSeek-V4-Pro-0813-versionen. Båda erbjuder ett kontextfönster på 1 miljon token, upp till 384 000 tokens med maximal effekt, och dubbla tänkande och icke-tänkande lägen, och båda kan användas som backend-modeller i agentverktyg som Claude Code, GitHub Copilot och OpenCode. DeepSeek levererar också en utvecklare förhandsvisning av "DeepSeek Harness", en verktygslåda för agentutvecklare. For more context on this story, see our ongoing latest AI developments.

Vad V4 Pro kostar

Det nya flaggskeppet har exakt tre gånger Flash-priset på varje nivå, enligt DeepSeeks publicerade prissättning. Per 1 miljon tokens listas V4 Pro på 0,022 $ för cachade indatatoken och 0,66 $ för icke-cachade indata under lågtrafik och 1,98 $ per 1 miljon output-tokens. På toppen fördubblas dessa siffror till $0,044, $1,32 och $3,96. V4 Flash, i jämförelse, listar på $0,007/$0,014 för cacheträffar, $0,22/$0,44 för cachemissar och $0,66/$1,32 för utdata.

Högbelastningstid definieras som 01:00–04:00 och 06:00–10:00 UTC, med lågtrafikpriser inställda på exakt hälften av topptrafiken. Samtidighet är också stegvis: Flash-kunder får 2 500 samtidiga förfrågningar, medan Pro-konton är begränsade till 500.

Priser upp så mycket som tiofaldigt

Lanseringstaken en vecka då DeepSeeks prisförändring blev omöjlig att missa. Wall Street Journal rapporterade den 14 augusti att DeepSeek hade höjt priserna på AI-modeller ungefär fyra gånger. InfoWorld rapporterade samma dag att vissa V4-priser hade stigit med mer än 10 gånger, med hänvisning till AI-efterfrågan som ansträngde företagets kapacitet. Engadget sa till läsarna att modellerna var "på väg att kosta fyra gånger mer."

Senast den 17 augusti rapporterade Tech Times att V4 API-priserna nu fyrdubblas vid rusningstid, medan Sydkoreas Seoul Economic Daily satte de brantaste ökningarna på upp till 12-faldiga och inramade flytten när Kinas AI-race övergick till vinst. Kinas statsanslutna Global Times beskrev vandringarna som en del av en push för "hälsosammare kommersialisering" - en signal om att Peking ser hållbar enhetsekonomi, inte bara marknadsandel, som prioritet för sina AI-mästare.

Från priskrigsvapen till premiumprodukt

Strategiskiftet är starkt. DeepSeek byggde sitt globala rykte på aggressiv prissättning: i slutet av juli jämfördes dess nysläppta V4 Flash-modell för att matcha OpenAI:s GPT-5.6 Luna till 60 % lägre kostnad, vilket påskyndade en kapplöpning mot botten som klämde alla API-leverantörer. Nu tar samma labb ut premiepriser – V4 Pros topppris på 3,96 USD per miljon tokens ligger långt över vad Flash-erans kunder var vana vid att betala.

Införandet av topp- och lågtrafikfönster är i sig ett verktyg för kapacitetshantering. Att ladda dubbelt under de mest hektiska timmarna – och minska samtidigheten för premiummodellen – låter DeepSeek-rationen beräkna mot arbetsbelastningar med högre marginaler, en spelbok som är bekant från molnleverantörer och elmarknader.

En tvåskiktsportfölj för agenteran

Fördelningen mellan de två modellerna är konstruerad för olika köpare. Flash, med sin samtidighetsgräns på 2 500 förfrågningar och minimal cache-hit-prissättning, är positionerad för produktionstrafik med stora volymer och kostnadskänsliga applikationer. Pro, med 500 samtidiga förfrågningar och det tredubbla priset, riktar sig mot resonemangstunga arbetsbelastningar där 1 miljon tokens kontextfönster och 384 000 tokens utmatningstak spelar roll – långa agentsessioner, stor kodbasanalys och dokumenttunga pipelines.

DeepSeek uppvaktar även utvecklare där de redan arbetar. Båda modellerna kan användas direkt som backends i Claude Code, GitHub Copilot och OpenCode, och API:n talar både OpenAI- och Anthropic-kompatibla format – vilket innebär att migrering från västerländska leverantörer kan vara en konfigurationsändring på en rad. Den nya utvecklarförhandsvisningen "DeepSeek Harness" utökar den strategin till att även bygga agenter.

Vad det betyder för utvecklare

För utvecklare som byggde kostnadskänsliga applikationer med antagandet att DeepSeek alltid skulle vara fyndalternativet, är budskapet att eran av oändligt fallande tokenpriser är över, åtminstone i det kinesiska labbet. Cache-vänliga arkitekturer betalar nu en 30 gånger lägre inmatningshastighet än cache-miss-anrop på båda modellerna, vilket gör prompt-caching-disciplinen mycket mer värdefull än modellval. Och för den bredare marknaden tar DeepSeeks pivot bort den mest aggressiva prissättaren från marknadens golv – en tyst gåva till OpenAI, Anthropic och Google, som har konkurrerat om kostnader lika mycket som kapacitet hela året.

Huruvida V4 Pros riktmärken motiverar premien återstår att testa av oberoende utvärderare. Det som redan är klart är affärslogiken: efter två år av subventionering av världens AI-användning vill DeepSeek få betalt för det.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →