De identiteit van Ox Alpha, het merkloze AI-model dat de gesprekken van ontwikkelaars domineert sinds het op 20 augustus op OpenRouter en OpenCode verscheen, is niet langer een mysterie. Het Chinese Z.AI bevestigde woensdag aan Bloomberg News dat het model een nieuwe versie is van zijn GLM-serie – en zei dat het de gewichten van het model vanavond zal vrijgeven, zodat iedereen ze kan downloaden en uitvoeren.
De bevestiging maakt een einde aan een van de meest waanzinnige gokspellen die de AI-gemeenschap dit jaar heeft gezien, en het zet een Chinees topmodel op ramkoers met westerse laboratoria die vergelijkbare mogelijkheden tegen een hoge premie prijzen. Voor meer context over dit verhaal, zie ons laatste AI-ontwikkelingen.
Een stealth-lancering die precies werkte zoals ontworpen
Ox Alpha arriveerde met een lijst waarin alles werd beschreven over wat het kon doen en niets over wie het had gebouwd. OpenRouter schreef het toe aan "een externe provider die ervoor heeft gekozen anoniem te blijven tijdens deze preview", en positioneerde het als een redeneermodel dat was gebouwd voor codering, langdurig agentisch werk en productiewerklasten.
Alleen al de specificaties waren genoeg om de aandacht te trekken: een contextvenster van iets meer dan een miljoen tokens, ondersteuning voor tekst-, beeld- en video-invoer, en volledig gratis toegang via zowel OpenRouter als OpenCode. OpenCode adverteerde met een capaciteit van 100 biljoen tokens per dag voor het model, en Nous Research beweerde dat zijn eigen portal een biljard tokens zou kunnen verwerken.
Door een grensoverschrijdend model anoniem op een neutrale infrastructuur te laten draaien, kan Z.AI echte gebruiksgegevens en ongefilterde benchmark-chatter verzamelen voordat het zijn merk eraan koppelt – een draaiboek dat het kortingsverhaal omzeilt dat volgt op elke open-weight Chinese release, zoals OfficeChai opmerkte in zijn analyse van de lancering.
De benchmarkrun die de zekering aanstak
De manie is terug te voeren op één enkel datapunt. Binnen een dag na de release voerde ontwikkelaar Ben Davis een informele evaluatie van tien taken uit op de DeepSWE-benchmark en rapporteerde hij een first-pass-nauwkeurigheid van 80 procent voor Ox Alpha – vóór Claude Fable 5 met 65 procent en GPT-5.6 Sol met 52 procent.
Dat resultaat was genoeg om het model viraal te laten gaan en een einde te maken aan de 56 dagen durende streak van DeepSeek bovenaan het OpenCode-klassement. Het lokte ook onmiddellijk weerstand uit. Op Hacker News, waar de bevestiging van Bloomberg honderden reacties opleverde, drongen de ontwikkelaars aan op voorzichtigheid, waarbij ze opmerkten dat een run van tien taken een veel te kleine steekproef is om iets te kunnen beslissen en dat de resultaten van het model op andere scoreborden merkbaar meer gemengd waren.
Hoe internet de zaak als eerste oploste
Lang vóór de bevestiging van woensdag had het recherchewerk van de gemeenschap al besloten dat Z.AI – voorheen bekend als Zhipu AI – de belangrijkste kandidaat was. Een ontwikkelaar die 'dax' gebruikte, voerde een tokenizer-vingerafdruktest uit op 25 prompts en ontdekte dat de onbewerkte tokentellingen van Ox Alpha bij 11 van de 11 sondes overeenkwamen met die van GLM, terwijl geen enkel ander laboratoriummodel er vier wist te wissen. Bij een sonde van één cijfer verbrandde de tokenizer van DeepSeek 98 tokens, terwijl GLM er 29 gebruikte.
Afzonderlijke analyse wees uit dat Ox Alpha op hetzelfde ‘vuile token’ stuitte dat historisch gezien Qwen- en GLM-familiemodellen heeft laten struikelen, waardoor het veld al vroeg werd beperkt tot een Chinees laboratorium. De andere prominente theorie – Xiaomi, wiens MiMo-team eerder een identiek stealth-launch-playbook had met MiMo-V2-Pro onder de alias Hunter Alpha – lijkt nu een afleidingsmanoeuvre te zijn geweest.
De inzet van de onthulling gaat verder dan opscheppen. De New York Times meldde dinsdag dat de modelrelease van een Chinees laboratorium de cyberveiligheidsbereidheid van de wereld zou kunnen testen, en onderstreepte hoe goed westerse regeringen open-weight releases van dit kaliber in de gaten houden.
Waarom open gewichten de calculus veranderen
De bevestiging van Z.AI dat er vanavond gewichten komen, is het deel dat belangrijk is voor de markt. De huidige GLM 5.3 van het bedrijf kost $1,40 per miljoen inputtokens en $4,40 per miljoen outputtokens op de first-party API, met een cachekorting van 81 procent. Volgens OfficeChai zal het nieuwe model naar verwachting worden geleverd onder dezelfde MIT-licentie die Z.AI sinds GLM 5 heeft gebruikt.
Grensoverschrijdende codering en agentische prestaties, openlijk vrijgegeven tegen een fractie van de westerse API-prijzen, is precies het drukpunt dat premiumlaboratoria twee jaar lang hebben geprobeerd te vermijden. Het houdt Z.AI ook concurrerend met DeepSeek aan de open kant van de Chinese markt, waar vrij downloadbare modellen de standaardverwachting zijn geworden voor alles wat minder is dan de absolute grens van een laboratorium.
Wat je nu moet bekijken
Belangrijke details blijven onbevestigd – vooral het aantal parameters en de modelgrootte, die zullen bepalen hoe praktisch de release is voor lokale implementatie. De discussie in de gemeenschap heeft zich al gericht op hoe het model reageert op kwantisering en hoe snel het op consumentenhardware draait in plaats van op datacenter-GPU's.
Wat zeker is, is dat een week van anonieme speculatie Z.AI iets heeft opgeleverd dat met geen enkel marketingbudget te koop is: onpartijdige, merkonafhankelijke validatie op neutraal terrein. Nu het model een naam heeft, staan de benchmarks op het punt een stuk drukker te worden – en een stuk strenger.
---
Blijf Voorop met AIHet laatste AI-nieuws, analyses en doorbraken — allemaal op één plek.
Lees meer AI-nieuws →