Kinesiska modeller för artificiell intelligens har dragit före sina amerikanska konkurrenter i global användning, enligt färska data från OpenRouter, världens största aggregeringsplattform för stora språkmodeller. Siffrorna, som rapporterades över flera butiker den 20 juni 2026, visar att system byggda av kinesiska laboratorier nu förbrukar fler tokens över hela världen än de från OpenAI, Google eller Anthropic – en förändring som drivs av aggressiv prissättning, ökande AI-agentarbetsbelastning och en våg av effektivitetsvinster som tvingas fram av amerikanska chipexportkontroller.

DeepSeek V4 Flash leder en kinesisk-dominerad ranking For more context on this story, see our ongoing AI news.

Enligt OpenRouter-data som citeras av The News International och bekräftas av CGTN och Firstpost, upptar kinesiska modeller nu toppen av den globala topplistan för token-konsumtion. DeepSeek V4 Flash rankades först med 4,63 biljoner tokens behandlade, följt av MiniMax M3 på 4,13 biljoner tokens och Xiaomis MiMo-V2.5 på 3,8 biljoner tokens.

Den bredare topp 10 inkluderade också Tencents Hy3, DeepSeek V4 Pro och Owl Alpha från kinesiska utvecklare, tillsammans med Anthropics Claude Opus 4.7, Claude Sonnet 4.6 och Claude Opus 4. Anthropic var det enda USA-baserade företaget som knäckte topp fem. Googles Gemini 2 och OpenAI:s GPT-5.5 gick betydligt sämre och landade på 12:e respektive 13:e plats.

Resultatet är slående eftersom OpenRouter inte är en kinesisk plattform. Grundat av Alex Atallah, tidigare CTO för NFT-marknadsplatsen OpenSea, erbjuder den en enda API-port till mer än 400 modeller från över 60 leverantörer, och dess transparenta användningsdata behandlas allmänt som en branschbarometer för vilka modeller utvecklare och företag faktiskt väljer att köra.

Varför tokens har blivit det nya slagfältet

En token är den minsta enhet som en AI-modell bearbetar – ett helt ord, ett fragment eller till och med ett enda tecken – och leverantörer fakturerar volymen av tokens som hanteras för både inmatning och utdata. Det gör tokenkonsumtion till en direkt proxy för hur mycket en modell används, och det har blivit den centrala prissättningsfronten i branschen.

Insatserna ökar snabbt på grund av AI-agenter. En enkel chatbot kan bränna runt 30 000 tokens som sammanfattar Shakespeares Hamlet, men en autonom agent som utför en kodningsuppgift kan konsumera upp till 20 miljoner tokens. Goldman Sachs har förutspått att spridningen av AI-agenter kommer att driva på en 24-faldig ökning av tokenkonsumtionen till 2030, vilket bidrar till en förväntad kristillförsel under de kommande 12 till 18 månaderna.

Kinesiska modeller vinner på kostnaden

Den centrala orsaken till Kinas försprång är priset. Rapportering från Trending Topics, baserad på OpenRouter-prisdata, visar att kinesiska modeller är ungefär 10 till 20 gånger billigare än ledande amerikanska alternativ. MiniMax M2.5, till exempel, debiterar cirka 0,30 USD per miljon inmatade tokens och 1,10 USD per miljon output-tokens, jämfört med cirka 5,00 USD och 25,00 USD för Anthropics Claude Opus 4.6.

Det gapet är enormt viktigt för agenter som hanterar enorma tokenvolymer kontinuerligt. Flera faktorer underbygger kostnadsfördelarna: billigare energi förstärkt av tunga statliga investeringar i förnybar energi, effektivare "Mixture-of-Experts"-arkitekturer och den disciplin som USA:s exportrestriktioner införde på avancerade chips, vilket tvingade kinesiska utvecklare att göra mer med mindre datoranvändning. Kinas regering har uttryckligen kopplat energipolitik och AI-konkurrenskraft som en nationell prioritet i sin arbetsplan för 2026.

Prestanda minskar gapet

Enbart pris skulle inte räcka om modellerna släpade efter i kvalitet. Men det tekniska gapet har minskat kraftigt. MiniMax M2.5 fick 80,2 % på SWE-Bench Verified, ett standardriktmärke för mjukvaruutvecklingsförmåga, bara knappt efter Claude Opus 4.6:s 80,8 %. Enligt analysplattformen Artificial Analysis har flera kinesiska modeller nu nått den globala toppnivån inom programmering, multimodal förståelse och långkontextbearbetning.

Adoptionsmönstret sträcker sig till amerikanska startups själva. Martin Casado från riskföretaget Andreessen Horowitz har uppskattat att cirka 80 % av unga AI-företag som bygger på öppen källkodsstack nu använder kinesiska modeller.

Amerikanska företag drar sig tillbaka till symboliska tak och budgetkontroller

OpenRouter-siffrorna landar i ett ögonblick då stora amerikanska företag drar tillbaka på fria AI-utgifter. Flera amerikanska företag går bort från schablonmässiga prenumerationer mot tokenbaserad fakturering, och företag inför hårda tak för att begränsa kostnaderna. Uber, Amazon, Microsoft och Meta har alla enligt uppgift begränsat tokenkonsumtionen de senaste veckorna eftersom kostnaden för att implementera AI i stor skala överstiger deras budgetar.

Microsofts nedskärning har varit särskilt synlig. Företaget beslutade nyligen att återkalla sin interna Claude-kodlicens för sin division Experiences and Devices, vilket avslutade åtkomsten den 30 juni 2026 – en signal om att även de största företagsköparna granskar ekonomin per token.

En föränderlig konkurrenskarta

OpenRouter-ögonblicksbilden fångar inte hela den globala marknaden – den återspeglar bara andelen användning som flödar genom en aggregator. Men färdriktningen överensstämmer med en bredare omställning där kinesiska laboratorier, som en gång avfärdades som snabba anhängare, alltmer sätter takten på de mätvärden som utvecklarna bryr sig mest om: pris, hastighet och tillräckligt bra kapacitet.

Om amerikanska labb reagerar genom att sänka priserna, luta sig hårdare mot premiumprestanda eller trycka på policyspakar återstår att se. För nu berättar tokendata en entydig historia: när utvecklare röstar med sina API-anrop vinner Kina.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →