Kinesiska labbet för artificiell intelligens DeepSeek släppte V4-Flash "0731" den 31 juli 2026, en omskolad version av sin budgetmodell som nästan matchar OpenAI:s GPT-5.6 Luna på riktmärken från tredje part till ungefär 60 procent lägre kostnad. Releasen, som sätter modellens offentliga beta-API i allmän tillgänglighet, är den senaste salvan i ett intensifierat priskrig mellan kinesiska leverantörer av öppen vikt och västra gränslaboratorier. För pågående bevakning av modellkrigen, kolla våra senaste AI-nyheter.
Enligt The Decoder får den nya versionen 50 poäng på Artificial Analysis Intelligence Index – ett tiopunkters hopp över den tidigare V4-Flash som lanserades i april 2026. Det placerar den bara en poäng bakom OpenAI:s budgetnivå GPT-5.6 Luna, trots att den kostar cirka 60 procent mindre per uppgift, även efter OpenAI:s senaste prissänkning på 80 procent.
Byggd för agentarbete
De största vinsterna kom i agentuppgifter, förmågan att självständigt slutföra verk i flera steg. TechNode rapporterade att modellen får 82,7 på Terminal Bench 2.1 och 54,4 på DeepSWE, två riktmärken utformade för att mäta hur väl en AI kan använda verktyg, skriva kod och lösa tekniska problem utan att hålla i handen.
På GDPval, ett riktmärke som testar modeller för komplext kontorsarbete, klättrade V4-Flash från 1 189 till 1 559 Elo-poäng. DeepSeek sa också att modellen hallucinerar mindre ofta än sin föregångare och använder ungefär 12 procent färre tokens för att utföra samma uppgifter.
Samma arkitektur, smartare vikter
Uppgraderingen behåller samma underliggande struktur: 284 miljarder parametrar totalt med 13 miljarder aktiva vid en viss tidpunkt och ett kontextfönster på en miljon token. Istället för att förstora modellen, tränade DeepSeek om den – vilket pressade mer prestanda ur samma fotavtryck. Modellvikterna släpps under den tillåtande MIT-licensen på Hugging Face, vilket fortsätter DeepSeeks öppna viktstrategi.
DeepSeek var noga med att omfånga releasen. Uppdateringen gäller endast för V4-Flash API; den högre nivån V4-Pro API och modellerna som serveras genom DeepSeeks konsumentapp och webbplats förblir oförändrade. Det nya Flash API lägger också till stöd för Responses API och är anpassat för användning med Codex, vilket breddar dess tilltal till utvecklare som bygger kodningsagenter.
Cache-rabattkanten
En betydande del av DeepSeeks kostnadsfördelar kommer från dess prismekanik. Företaget erbjuder en cache-rabatt på 98 procent – långt över industristandarden på 90 procent – vilket innebär att upprepade eller förutsägbara delar av en förfrågan faktureras till en liten bråkdel av den normala kostnaden. I kombination med färre tokens per uppgift sjunker den effektiva kostnaden för många arbetsbelastningar dramatiskt.
Den prisstrukturen är en direkt utmaning för OpenAI, som själv har sänkt priserna för att försvara marknadsandelar. Resultatet är en marknad där gränsöverskridande kvalitet håller på att bli en handelsvara, och konkurrensen avgörs alltmer av infrastruktureffektivitet och enhetsekonomi snarare än rå kapacitet.
Ett priskrig utan golv
Releasen intensifierar det som analytiker nu beskriver som ett fullblåst priskrig. OpenAI sänkte priserna på GPT-5.6 Luna med 80 procent för att försvara sin utvecklarbas, bara för DeepSeek att svara med en modell som är jämförbart kapabel och fortfarande mycket billigare. Varje omgång sänker den effektiva kostnaden för intelligens nära gränserna, och gapet mellan de billigaste och dyraste kapabla modellerna fortsätter att minska.
Dynamiken är ovanlig i mjukvara. På de flesta marknader skulle en kostnadsfördel på 60 procent vid nästan likvärdig kvalitet snabbt ta andelar. Här är fördelen att matchas och återmatchas inom några veckor, vilket lämnar utvecklare med en ständigt föränderlig topplista. Benchmark-paritet, en gång den exklusiva provinsen för gränslaboratorier, är alltmer tillgänglig från utmanare med öppen vikt som är villiga att publicera både sina vikter och sin prissättning.
Vad det betyder för utvecklare
För utvecklare är den praktiska innebörden tydlig: kapabla agentmodeller blir snabbt billigare. En modell som autonomt kan navigera i en terminal, skriva och felsöka kod och hantera komplexa kontorsuppgifter – allt till en bråkdel av en cent per förfrågan – förändrar ekonomin för att bygga AI-drivna produkter.
Den öppna utgåvan innebär också att team kan köra modellen på sin egen hårdvara och undvika API-avgifter per token helt för känsliga arbetsbelastningar. När DeepSeek, OpenAI och andra fortsätter att byta ut slag på pris och prestanda, är vinnarna byggarna som nu har en växande meny med kapabla, prisvärda modeller att välja mellan.
Ligg före AI-kurvan
Landskapet med artificiell intelligens rör sig snabbare än någonsin, och de företag som spårar dessa förändringar tidigt får en bestående fördel. Följ våra senaste AI-nyheter för kontinuerlig, källkontrollerad täckning av modellreleaser, finansieringsrundor och policyrörelser.
Läs mer AI-nyheter →