Chinese kunstmatige-intelligentiemodellen hebben hun Amerikaanse concurrenten voor op het gebied van mondiaal gebruik, zo blijkt uit nieuwe gegevens van OpenRouter, 's werelds grootste aggregatieplatform voor grote taalmodellen. De cijfers, die op 20 juni 2026 via meerdere kanalen zijn gerapporteerd, laten zien dat systemen die door Chinese laboratoria zijn gebouwd nu wereldwijd meer tokens verbruiken dan die van OpenAI, Google of Anthropic – een verschuiving die wordt veroorzaakt door agressieve prijzen, stijgende werklasten van AI-agenten en een golf van efficiëntiewinsten die worden afgedwongen door Amerikaanse chipexportcontroles.

DeepSeek V4 Flash leidt een door China gedomineerde ranglijst Voor meer context over dit verhaal, zie ons AI-nieuws.

Volgens gegevens van OpenRouter, geciteerd door The News International en bevestigd door CGTN en Firstpost, bezetten Chinese modellen nu de top van het mondiale klassement op het gebied van tokenconsumptie. DeepSeek V4 Flash staat op de eerste plaats met 4,63 biljoen tokens verwerkt, gevolgd door MiniMax M3 met 4,13 biljoen tokens en Xiaomi's MiMo-V2.5 met 3,8 biljoen tokens.

De bredere top 10 omvatte ook Tencent's Hy3, DeepSeek V4 Pro en Owl Alpha van Chinese ontwikkelaars, naast Claude Opus 4.7, Claude Sonnet 4.6 en Claude Opus 4 van Anthropic. Anthropic was het enige in de VS gevestigde bedrijf dat de top vijf wist te bereiken. Google's Gemini 2 en OpenAI's GPT-5.5 deden het aanzienlijk slechter en belandden respectievelijk op de 12e en 13e plaats.

Het resultaat is opvallend omdat OpenRouter geen Chinees platform is. Opgericht door Alex Atallah, de voormalige CTO van de NFT-marktplaats OpenSea, biedt het één API-gateway voor meer dan 400 modellen van meer dan 60 providers, en de transparante gebruiksgegevens worden algemeen beschouwd als een sectorbarometer van welke modellen ontwikkelaars en bedrijven daadwerkelijk kiezen om te gebruiken.

Waarom tokens het nieuwe slagveld zijn geworden

Een token is de kleinste eenheid die een AI-model verwerkt – een heel woord, een fragment of zelfs een enkel teken – en providers factureren op basis van het aantal tokens dat wordt verwerkt voor zowel invoer als uitvoer. Dat maakt tokenconsumptie een directe indicatie van hoe intensief een model wordt gebruikt, en het is het centrale prijsfront in de sector geworden.

De inzet stijgt snel dankzij AI-agenten. Een eenvoudige chatbot kan ongeveer 30.000 tokens verbranden, een samenvatting van Shakespeare's Hamlet, maar een autonome agent die een codeertaak uitvoert, kan tot 20 miljoen tokens verbruiken. Goldman Sachs heeft voorspeld dat de verspreiding van AI-agenten tegen 2030 een 24-voudige toename van het tokenverbruik zal veroorzaken, wat zal bijdragen aan een verwachte krapte op het gebied van het aanbod van chips in de komende 12 tot 18 maanden.

Chinese modellen winnen op het gebied van kosten

De belangrijkste reden voor de Chinese voorsprong is de prijs. Uit rapporten van Trending Topics, gebaseerd op prijsgegevens van OpenRouter, blijkt dat Chinese modellen grofweg 10 tot 20 keer goedkoper zijn dan toonaangevende Amerikaanse alternatieven. MiniMax M2.5 rekent bijvoorbeeld ongeveer $0,30 per miljoen inputtokens en $1,10 per miljoen outputtokens, vergeleken met ongeveer $5,00 en $25,00 voor Claude Opus 4.6 van Anthropic.

Die kloof is enorm van belang voor agentische workloads die continu enorme tokenvolumes verwerken. Verschillende factoren liggen ten grondslag aan het kostenvoordeel: goedkopere energie, ondersteund door zware staatsinvesteringen in hernieuwbare energiebronnen, efficiëntere ‘Mixture-of-Experts’-architecturen en de discipline die wordt opgelegd door Amerikaanse exportbeperkingen op geavanceerde chips, waardoor Chinese ontwikkelaars gedwongen werden meer te doen met minder rekenkracht. De Chinese regering heeft in haar werkplan voor 2026 expliciet het energiebeleid en het concurrentievermogen van AI als nationale prioriteit aan elkaar gekoppeld.

Prestaties dichten de kloof

Prijs alleen zou niet genoeg zijn als de modellen achterbleven in kwaliteit. Maar de technische kloof is scherp kleiner geworden. MiniMax M2.5 scoorde 80,2% op SWE-Bench Verified, een standaard benchmark voor software-engineeringmogelijkheden, slechts nipt achter de 80,8% van Claude Opus 4.6. Volgens het analyseplatform Artificial Analysis hebben verschillende Chinese modellen nu het mondiale topniveau bereikt op het gebied van programmeren, multimodaal begrip en verwerking van lange contexten.

Het adoptiepatroon strekt zich uit tot Amerikaanse startups zelf. Martin Casado van het durfkapitaalbedrijf Andreessen Horowitz schat dat ongeveer 80% van de jonge AI-bedrijven die voortbouwen op open source-stacks nu Chinese modellen gebruiken.

Amerikaanse bedrijven trekken zich terug op token caps en budgetcontroles

De cijfers van OpenRouter komen op een moment waarop grote Amerikaanse bedrijven hun ongebreidelde AI-uitgaven terugschroeven. Verschillende Amerikaanse bedrijven stappen over van abonnementen met een vast tarief naar facturering op basis van tokens, en bedrijven introduceren hard caps om de kosten binnen de perken te houden. Uber, Amazon, Microsoft en Meta hebben naar verluidt de afgelopen weken allemaal het tokenverbruik beperkt, omdat de kosten van het op grote schaal inzetten van AI hun budgetten overschrijden.

Vooral de bezuinigingen van Microsoft waren zichtbaar. Het bedrijf heeft onlangs besloten om de interne Claude-codelicentie voor zijn divisie Experiences and Devices in te trekken, waardoor de toegang op 30 juni 2026 wordt beëindigd – een signaal dat zelfs de grootste zakelijke kopers de economie per token onder de loep nemen.

Een veranderende concurrentiekaart

De momentopname van OpenRouter omvat niet de gehele wereldmarkt; het weerspiegelt alleen het deel van het gebruik dat door één aggregator stroomt. Maar de reisrichting komt overeen met een bredere herschikking waarin Chinese laboratoria, ooit afgedaan als snelle volgers, steeds meer het tempo bepalen op de maatstaven waar ontwikkelaars het meest om geven: prijs, snelheid en goede capaciteiten.

Of Amerikaanse laboratoria hierop zullen reageren door de prijzen te verlagen, harder op topprestaties te leunen of door beleidshefbomen te stimuleren, valt nog te bezien. Voorlopig vertellen de tokengegevens een ondubbelzinnig verhaal: wanneer ontwikkelaars stemmen met hun API-aanroepen, wint China.

---

Blijf Voorop met AI

Het laatste AI-nieuws, analyses en doorbraken — allemaal op één plek.

Lees meer AI-nieuws →