Het Chinese kunstmatige-intelligentielaboratorium DeepSeek heeft op 31 juli 2026 V4-Flash "0731" uitgebracht, een opnieuw getrainde versie van zijn budgetmodel dat bijna overeenkomt met OpenAI's GPT-5.6 Luna op benchmarks van derden, tegen ongeveer 60 procent lagere kosten. De release, die de publieke bèta-API van het model algemeen beschikbaar maakt, is het nieuwste salvo in een intensivering van de prijzenoorlog tussen Chinese aanbieders van open gewichten en laboratoria aan de westerse grens. Voor voortdurende berichtgeving over de modeloorlogen, bekijk ons ​​[laatste AI-nieuws] (https://aibuzzwire.news).

Volgens The Decoder scoort de nieuwe versie 50 punten op de Artificial Analysis Intelligence Index – een sprong van tien punten ten opzichte van de vorige V4-Flash die in april 2026 werd gelanceerd. Dat plaatst hem slechts één punt achter OpenAI's budgettier GPT-5.6 Luna, ondanks dat hij ongeveer 60 procent minder per taak kost, zelfs na OpenAI's recente prijsverlaging van 80 procent.

Gebouwd voor agentwerk

De grootste winst kwam op het gebied van agentische taken, het vermogen om autonoom werk in de echte wereld in meerdere stappen uit te voeren. TechNode meldde dat het model 82,7 scoort op Terminal Bench 2.1 en 54,4 op DeepSWE, twee benchmarks die zijn ontworpen om te meten hoe goed een AI tools kan gebruiken, code kan schrijven en technische problemen kan oplossen zonder de hand vast te houden.

Op GDPval, een benchmark die modellen test voor complex kantoorwerk, steeg V4-Flash van 1.189 naar 1.559 Elo-punten. DeepSeek zei ook dat het model minder vaak hallucineert dan zijn voorganger en ongeveer 12 procent minder tokens gebruikt om dezelfde taken uit te voeren.

Dezelfde architectuur, slimmere gewichten

De upgrade behoudt dezelfde onderliggende structuur: 284 miljard totale parameters waarvan er 13 miljard tegelijkertijd actief zijn, en een contextvenster van één miljoen tokens. In plaats van het model te vergroten, heeft DeepSeek het opnieuw getraind, waardoor meer prestaties uit dezelfde footprint werden gehaald. De modelgewichten worden vrijgegeven onder de tolerante MIT-licentie op Hugging Face, waarmee de open-gewichtbenadering van DeepSeek wordt voortgezet.

DeepSeek heeft de release zorgvuldig in kaart gebracht. De update is alleen van toepassing op de V4-Flash API; de hogere V4-Pro API en de modellen die worden aangeboden via de consumentenapp en website van DeepSeek blijven ongewijzigd. De nieuwe Flash API voegt ook ondersteuning toe voor de Responses API en is aangepast voor gebruik met Codex, waardoor de aantrekkingskracht ervan wordt vergroot voor ontwikkelaars die codeeragenten bouwen.

De cachekortingsvoorsprong

Een aanzienlijk deel van het kostenvoordeel van DeepSeek komt voort uit het prijsmechanisme. Het bedrijf biedt een cachekorting van 98 procent – ​​ruim boven de industriestandaard van 90 procent – ​​wat betekent dat herhaalde of voorspelbare delen van een verzoek tegen een klein deel van het normale tarief worden gefactureerd. Gecombineerd met minder tokens per taak dalen de effectieve kosten voor veel workloads dramatisch.

Die prijsstructuur is een directe uitdaging voor OpenAI, dat zelf de prijzen heeft verlaagd om marktaandeel te verdedigen. Het resultaat is een markt waar grensverleggende kwaliteit een handelswaar wordt, en de concurrentie steeds meer wordt bepaald door de efficiëntie van de infrastructuur en de eenheidseconomie in plaats van door pure capaciteit.

Een prijzenoorlog zonder bodem

De publicatie intensiveert wat analisten nu omschrijven als een regelrechte prijzenoorlog. OpenAI verlaagde de GPT-5.6 Luna-prijzen met 80 procent om zijn ontwikkelaarsbestand te verdedigen, waarna DeepSeek kon antwoorden met een model dat vergelijkbaar capabel is en nog steeds veel goedkoper. Elke ronde duwt de effectieve kosten van near-frontier intelligence lager, en de kloof tussen de goedkoopste en duurste capabele modellen wordt steeds kleiner.

De dynamiek is ongebruikelijk in software. In de meeste markten zou een kostenvoordeel van 60 procent bij vrijwel gelijke kwaliteit snel marktaandeel veroveren. Hier wordt het voordeel binnen enkele weken gematcht en opnieuw gematcht, waardoor ontwikkelaars een voortdurend veranderend klassement krijgen. Benchmarkpariteit, ooit de exclusieve provincie van grenslaboratoria, is in toenemende mate beschikbaar voor uitdagers met een open gewicht die bereid zijn zowel hun gewichten als hun prijzen te publiceren.

Wat het betekent voor ontwikkelaars

Voor ontwikkelaars is de praktische implicatie duidelijk: capabele agentische modellen worden snel goedkoper. Een model dat autonoom door een terminal kan navigeren, code kan schrijven en fouten kan opsporen en complexe kantoortaken kan afhandelen – en dat allemaal voor een fractie van een cent per verzoek – verandert de economie van het bouwen van AI-aangedreven producten.

De open-weight release betekent ook dat teams het model op hun eigen hardware kunnen draaien, waardoor API-kosten per token voor gevoelige workloads volledig worden vermeden. Terwijl DeepSeek, OpenAI en anderen klappen blijven uitdelen op het gebied van prijs en prestaties, zijn de winnaars de bouwers die nu een groeiend menu van capabele, betaalbare modellen hebben om uit te kiezen.

Blijf de AI-curve een stap voor

Het kunstmatige-intelligentielandschap ontwikkelt zich sneller dan ooit, en de bedrijven die deze verschuivingen vroegtijdig volgen, verwerven een blijvende voorsprong. Volg ons [laatste AI-nieuws] (https://aibuzzwire.news) voor voortdurende, door de bronnen gecontroleerde berichtgeving over modelreleases, financieringsrondes en beleidswijzigingen.

Lees meer AI-nieuws →