Chińskie laboratorium sztucznej inteligencji MiniMax przyjęło niezwykłe podejście do swojego najnowszego wydania: ledwo to przyznało. 27 września oficjalne konto firmy potwierdziło to, co programiści już zauważyli w produkcie — nowy model o nazwie M3.1-Flash-Preview został uruchomiony w MiniMax Code, asystencie kodowania firmy. Taki był zakres wprowadzenia na rynek: brak karty modelu, brak tabeli porównawczej, brak ceny za milion tokenów.

Według Startup Fortune chińscy obserwatorzy sztucznej inteligencji na X zauważyli pojawienie się modelu w produkcie przed potwierdzeniem. Wyciszony rozwój stanowi uderzający kontrast w stosunku do tego, w jaki sposób MiniMax dostarczył swój ostatni flagowiec. Więcej kontekstu na ten temat znajdziesz w naszych najnowsze osiągnięcia AI.

Celowo cichy debiut

Kiedy w czerwcu MiniMax wypuścił M3, firma opublikowała szczegóły architektury, wyniki testów SWE i arkusz cenowy, który podciął konkurencję o 90%. Tym razem punkt końcowy API dla M3.1-Flash-Preview jest bramkowany i jedynym sposobem wypróbowania modelu jest użycie własnego produktu MiniMax, gdzie głównymi obserwowalnymi sygnałami są ślady rozumowania i zachowanie.

Strategia powściągliwości sugeruje, że MiniMax może traktować premierę nie jako główną premierę, a bardziej jako eksperyment: testowanie A/B funkcji produktu i pozwalanie, aby Internet się o tym dowiedział. Może to odzwierciedlać pewność, że model będzie mówił sam za siebie, gdy deweloperzy go użyją — lub po prostu to, że to wydanie nie jest najważniejsze, ale szybszą i tańszą warstwę towarzyszącą.

Co mówi nam baza M3

Podstawowy model M3 daje wyobrażenie o tym, co MiniMax może wysłać, gdy potrzebuje uwagi. Jest to złożony z ekspertów model składający się z 428 miliardów parametrów, z około 23 miliardami aktywnych parametrów na token, oknem kontekstowym obejmującym milion tokenów oraz natywnym wejściem obrazu i wideo. W SWE-bench Verified MiniMax odnotował wynik 80,5%.

Flash to wersja linii stworzona z myślą o zwiększeniu szybkości i przewagi cenowej w codziennym kodowaniu — szybkie poprawki błędów i drobne prace nad funkcjami są uruchamiane dziesiątki razy dziennie przez programistów, zamiast długoterminowych zadań agenta zarezerwowanych dla produktu flagowego. Podział linii modeli w ten sposób na dużą wersję frontierową i szybki, tani dodatek stał się standardowym podręcznikiem wśród chińskich laboratoriów konkurujących o wymianę doświadczeń programistów.

Wysyłka na zatłoczone pole

MiniMax nie wypuszcza na spokojny rynek. Alibaba wypuściła Qwen3.8-Max 3 sierpnia – okręt flagowy o 2,4 bilionach parametrów wyceniony na 2 dolary za milion tokenów wejściowych – a następnie 12 sierpnia wypuściła pierwszą wersję modelu Qwen z maksymalną wagą o otwartej wadze. GLM-5.3 firmy Zhipu wylądował 14 sierpnia z własnym oknem kontekstowym zawierającym milion tokenów.

Deweloperzy zauważyli zalew wydajnych i niedrogich opcji. Według raportów CNBC na temat danych OpenRouter chińskie modele odpowiadały za 57–67% całkowitego wykorzystania tokenów na platformie w tygodniu obejmującym 14 września – wzrost z zaledwie 6% do 13% w lutym. Podobny skok odnotował Vercel, a udział chińskich modeli w wykorzystaniu jego platformy wzrósł w sierpniu do 55%.

Waszyngton patrzy

Gwałtowny wzrost przyciągnął uwagę nie tylko społeczności programistów. Daniel Remler, starszy specjalista w programie technologii i bezpieczeństwa narodowego w Center for a New American Security, powiedział CNBC, że chińska sztuczna inteligencja stanowi „rzeczywiste ryzyko gospodarcze i bezpieczeństwo dla Stanów Zjednoczonych”, ostrzegając przed włączaniem chińskich modeli do kluczowych przepływów pracy.

Ta analiza dodaje warstwę złożoności do cichego wydania MiniMax. Model dostarczany bez karty modelu, opublikowanych ocen i cen daje niezależnym programistom mniej możliwości współpracy przy ocenie jakości i bezpieczeństwa – nawet jeśli produkty laboratorium zyskują rzeczywisty udział w użytkowaniu w porównaniu z amerykańskimi rywalami.

Dlaczego cichy start może mieć znaczenie strategiczne

Modele podglądu wbudowane we własny produkt firmy to znany schemat: generują dane o użytkowaniu i opinie przed szerszą wersją interfejsu API, ograniczając jednocześnie ekspozycję w przypadku słabszych wyników modelu. W przypadku MiniMax wyciszony debiut M3.1-Flash-Preview może być również sposobem na zwrócenie uwagi na większą premierę — według raportów cytowanych przez Startup Fortune firma ponad dwukrotnie zwiększyła sprzedaż podczas przygotowywania nowego flagowego modelu.

Dla programistów praktyczny wniosek jest prosty: nowy poziom szybkiego kodowania z jednego z wiodących chińskich laboratoriów jest już dostępny w MiniMax Code, a wciąż brakuje standardów i cen, które normalnie obejmowałyby taką wersję. To, czy M3.1-Flash-Preview może zwiększyć dynamikę, która zapewniła chińskim modelom większość ruchu OpenRouter, będzie zależeć od tego, jak będzie działać, gdy programiści zaczną przesyłać przez niego prawdziwe obciążenia.

---

Bądź na Bieżąco z AI

Najnowsze wiadomości, analizy i przełomy w dziedzinie AI — wszystko w jednym miejscu.

Czytaj więcej wiadomości AI →