Laboratorul chinezesc de inteligență artificială MiniMax a adoptat o abordare neobișnuită față de ultima sa lansare: abia a recunoscut-o. Pe 27 septembrie, contul oficial al companiei a confirmat ceea ce dezvoltatorii au observat deja în produs - un nou model numit M3.1-Flash-Preview a fost lansat în MiniMax Code, asistentul de codare al companiei. Aceasta a fost amploarea lansării: fără model de card, fără tabel de referință, fără preț pe milion de jetoane.
Observatorii chinezi AI de pe X au observat că modelul apare în produs înainte de confirmare, potrivit Startup Fortune. Lansarea dezactivată este un contrast izbitor cu modul în care MiniMax și-a livrat ultimul său flagship. For more context on this story, see our ongoing artificial intelligence updates.
Un debut în mod deliberat liniștit
Când MiniMax a lansat M3 în iunie, compania a publicat detalii de arhitectură, scoruri SWE-bench și o fișă de prețuri care subcut rivalii cu 90%. De data aceasta, punctul final API pentru M3.1-Flash-Preview este închis și singura modalitate de a încerca modelul este în interiorul propriului produs MiniMax, cu urme de raționament și comportament ca principale semnale observabile.
Strategia discretă sugerează că MiniMax poate trata lansarea mai puțin ca pe o lansare de titlu și mai mult ca un experiment: A/B testează o caracteristică a produsului și lasă internetul să afle. Acest lucru ar putea reflecta încrederea că modelul va vorbi de la sine odată ce dezvoltatorii îl vor folosi - sau pur și simplu că această versiune nu este cea mare, ci un nivel de însoțitor mai rapid și mai ieftin.
Ce ne spune Base M3
Modelul de bază M3 oferă o idee despre ceea ce MiniMax poate livra atunci când dorește atenție. Este un model de amestec de experți cu 428 de miliarde de parametri, cu aproximativ 23 de miliarde de parametri activi pe token, o fereastră de context de un milion de token și intrare nativă de imagine și video. Pe SWE-bench Verified, MiniMax a raportat un scor de 80,5%.
Flash este versiunea liniei construită pentru a spori acel avantaj de viteză și preț pentru codificarea de zi cu zi — remedierea rapidă a erorilor și dezvoltatorii de funcții mici rulează de zeci de ori pe zi, mai degrabă decât sarcinile agentice cu orizont lung rezervate navei emblematice. Împărțirea unei linii de model în acest fel, cu o versiune de frontieră mare și un însoțitor rapid și ieftin, a devenit manualul standard în rândul laboratoarelor chineze care concurează pentru partajarea mentală a dezvoltatorilor.
Expediere într-un câmp aglomerat
MiniMax nu se lansează pe o piață liniștită. Alibaba a lansat Qwen3.8-Max pe 3 august – o navă emblematică cu 2,4 trilioane de parametri la prețul de 2 USD per milion de jetoane de intrare – apoi a urmat pe 12 august prima versiune open-weight a unui model Qwen de nivel Max. GLM-5.3 de la Zhipu a aterizat pe 14 august cu o fereastră de context de un milion de jetoane.
Dezvoltatorii au observat un val de opțiuni capabile și ieftine. Potrivit raportărilor CNBC privind datele OpenRouter, modelele chineze au reprezentat 57% până la 67% din utilizarea totală a token-ului pe platformă pentru săptămâna care a inclus 14 septembrie - de la doar 6% la 13% în februarie. Vercel a înregistrat un salt similar, cota de utilizare a modelelor chineze pe platforma sa crescând la 55% în august.
Washington se uită
Creșterea a atras atenția dincolo de comunitățile de dezvoltatori. Daniel Remler, membru senior în programul de tehnologie și securitate națională la Center for a New American Security, a declarat pentru CNBC că AI chinezesc reprezintă „riscuri economice și de securitate reale pentru Statele Unite”, avertizând împotriva integrării modelelor chineze în fluxurile de lucru critice.
Acest control adaugă un strat de complexitate lansării silențioase a MiniMax. Un model care vine fără un card de model, evaluări publicate sau prețuri oferă dezvoltatorilor independenți mai puțin cu care să lucreze atunci când evaluează calitatea și siguranța - chiar dacă produsele laboratorului câștigă o cotă reală de utilizare față de rivalii americani.
De ce lansarea liniștită poate fi strategică
Modelele de previzualizare închise în interiorul propriului produs al unei companii sunt un model familiar: generează date de utilizare și feedback înainte de o lansare mai largă a API, limitând în același timp expunerea dacă modelul are performanțe slabe. Pentru MiniMax, debutul suprimat al lui M3.1-Flash-Preview poate fi, de asemenea, o modalitate de a ține lumina reflectoarelor pentru o lansare mai mare - compania și-a dublat vânzările în timp ce pregătește un nou model emblematic, potrivit raportului citat de Startup Fortune.
Pentru dezvoltatori, concluzia practică este simplă: un nou nivel de codare rapidă de la unul dintre laboratoarele de top din China este disponibil acum în MiniMax Code, iar criteriile de referință și prețurile care ar încadra în mod normal o astfel de lansare încă lipsesc. Dacă M3.1-Flash-Preview poate extinde impulsul care a adus modelele chineze la o cotă majoritară din traficul OpenRouter, va depinde de modul în care va funcționa odată ce dezvoltatorii încep să împingă sarcini reale de lucru prin intermediul acestuia.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →