Het Chinese AI-lab MiniMax heeft een ongebruikelijke benadering gekozen voor zijn nieuwste release: het heeft het nauwelijks erkend. Op 27 september bevestigde het officiële account van het bedrijf wat ontwikkelaars al in het product hadden opgemerkt: een nieuw model genaamd M3.1-Flash-Preview was live gegaan in MiniMax Code, de codeerassistent van het bedrijf. Dat was de omvang van de lancering: geen modelkaart, geen benchmarktabel, geen prijs per miljoen tokens.

Chinese AI-watchers op X hadden volgens Startup Fortune opgemerkt dat het model vóór de bevestiging in het product verscheen. De gedempte uitrol staat in schril contrast met hoe MiniMax zijn laatste vlaggenschip verscheepte. Voor meer context over dit verhaal, zie ons meer AI-verhalen.

Een opzettelijk rustig debuut

Toen MiniMax in juni M3 lanceerde, publiceerde het bedrijf architectuurdetails, SWE-benchscores en een prijsoverzicht dat de rivalen met 90% ondermijnde. Deze keer is het API-eindpunt voor M3.1-Flash-Preview beveiligd en de enige manier om het model uit te proberen is binnen MiniMax's eigen product, met redeneersporen en gedrag als de belangrijkste waarneembare signalen.

De ingehouden strategie suggereert dat MiniMax de release misschien minder als een headline-lancering behandelt en meer als een experiment: A/B-testen van een productfunctie en het internet dit laten ontdekken. Dat zou het vertrouwen kunnen weerspiegelen dat het model voor zichzelf zal spreken zodra ontwikkelaars het gebruiken – of simpelweg dat deze release niet de grote is, maar een snellere, goedkopere aanvulling.

Wat de basis M3 ons vertelt

Het basismodel M3 biedt een idee van wat MiniMax kan verzenden als het aandacht nodig heeft. Het is een mengsel van experts met 428 miljard parameters, met ongeveer 23 miljard actieve parameters per token, een contextvenster van één miljoen tokens en native beeld- en video-invoer. Op SWE-bench Verified rapporteerde MiniMax een score van 80,5%.

Flash is de versie van de lijn die is gebouwd om dat snelheids- en prijsvoordeel voor alledaagse codering te vergroten - de snelle bugfixes en kleine feature-werkontwikkelaars worden tientallen keren per dag uitgevoerd, in plaats van de lange horizon-agentische taken die zijn gereserveerd voor het vlaggenschip. Het op deze manier opsplitsen van een modellijn, met een grote grensversie en een snelle, goedkope metgezel, is het standaardboek geworden onder Chinese laboratoria die strijden om de mindshare van ontwikkelaars.

Verzending naar een druk veld

MiniMax komt niet op een rustige markt terecht. Alibaba bracht op 3 augustus Qwen3.8-Max uit – een vlaggenschip met 2,4 biljoen parameters, geprijsd op $2 per miljoen inputtokens – en volgde op 12 augustus met de eerste open-weight-versie van een Max-tier Qwen-model. Zhipu's GLM-5.3 landde op 14 augustus met een eigen contextvenster van een miljoen token.

Ontwikkelaars hebben de stroom aan capabele, goedkope opties opgemerkt. Volgens de rapportage van CNBC over OpenRouter-gegevens waren Chinese modellen verantwoordelijk voor 57% tot 67% van het totale tokengebruik op het platform voor de week inclusief 14 september – een stijging van slechts 6% naar 13% in februari. Vercel zag een soortgelijke sprong, waarbij het gebruiksaandeel van Chinese modellen op zijn platform in augustus steeg tot 55%.

Washington kijkt toe

De golf heeft de aandacht getrokken tot ver buiten de ontwikkelaarsgemeenschappen. Daniel Remler, een senior fellow in het technologie- en nationale veiligheidsprogramma van het Center for a New American Security, vertelde CNBC dat Chinese AI ‘echte economische en veiligheidsrisico’s voor de Verenigde Staten’ vertegenwoordigt, en waarschuwt tegen het integreren van Chinese modellen in kritische workflows.

Dat onderzoek voegt een laagje complexiteit toe aan de stille release van MiniMax. Een model dat zonder modelkaart, gepubliceerde evaluaties of prijzen arriveert, geeft onafhankelijke ontwikkelaars minder om mee te werken bij het beoordelen van kwaliteit en veiligheid – zelfs als de producten van het laboratorium een ​​reëel gebruiksaandeel winnen ten opzichte van Amerikaanse rivalen.

Waarom de stille lancering strategisch kan zijn

Preview-modellen binnen het eigen product van een bedrijf zijn een bekend patroon: ze genereren gebruiksgegevens en feedback vóór een bredere API-release, terwijl de blootstelling wordt beperkt als het model ondermaats presteert. Voor MiniMax kan het gedempte debuut van M3.1-Flash-Preview ook een manier zijn om de schijnwerpers vast te houden voor een grotere lancering – het bedrijf heeft de omzet meer dan verdubbeld terwijl het een nieuw vlaggenschipmodel voorbereidt, volgens rapporten geciteerd door Startup Fortune.

Voor ontwikkelaars is de praktische boodschap eenvoudig: een nieuwe snelle coderingslaag van een van China's toonaangevende laboratoria is nu live in MiniMax Code, en de benchmarks en prijzen die normaal gesproken een dergelijke release zouden omlijsten, ontbreken nog steeds. Of M3.1-Flash-Preview het momentum kan vergroten dat Chinese modellen naar een meerderheidsaandeel van OpenRouter-verkeer bracht, zal afhangen van hoe het presteert zodra ontwikkelaars er echte werklasten doorheen gaan duwen.

---

Blijf Voorop met AI

Het laatste AI-nieuws, analyses en doorbraken — allemaal op één plek.

Lees meer AI-nieuws →