Китайська лабораторія штучного інтелекту MiniMax застосувала незвичний підхід до свого останнього випуску: вона майже не визнала це. 27 вересня офіційний обліковий запис компанії підтвердив те, що розробники вже помітили в продукті — нова модель під назвою M3.1-Flash-Preview запрацювала в MiniMax Code, помічнику компанії з кодування. Це був масштаб запуску: без моделі картки, без порівняльної таблиці, без ціни за мільйон токенів.

За даними Startup Fortune, китайські дослідники ШІ на X помітили, що модель з’явилася в продукті ще до підтвердження. Приглушене розгортання є разючим контрастом із тим, як MiniMax поставив свій останній флагман. For more context on this story, see our ongoing latest AI developments.

Навмисне тихий дебют

Коли MiniMax запустила M3 у червні, компанія опублікувала деталі архітектури, оцінки SWE-стенду та цінову таблицю, яка знизила конкурентів на 90%. Цього разу кінцева точка API для M3.1-Flash-Preview закрита, і єдиний спосіб випробувати модель — у власному продукті MiniMax із слідами міркування та поведінкою як основними спостережуваними сигналами.

Стримана стратегія припускає, що MiniMax може сприймати випуск не так як заголовок, а більше як експеримент: A/B тестування функції продукту та надання інформації Інтернету. Це може свідчити про впевненість у тому, що модель буде говорити сама за себе, коли розробники її використають — або просто про те, що цей випуск не є великим, а швидшим і дешевшим супутнім рівнем.

Що говорить нам Base M3

Базова модель M3 дає відчуття того, що MiniMax може постачати, коли вона потребує уваги. Це експертна модель із 428 мільярдами параметрів із приблизно 23 мільярдами активних параметрів на токен, контекстним вікном із мільйоном токенів і власним введенням зображень і відео. На SWE-bench Verified, MiniMax повідомила про результат 80,5%.

Flash — це версія лінійки, створена для посилення цієї швидкісної та цінової переваги для повсякденного кодування — швидкі виправлення помилок і невеликі функції, які розробники виконують десятки разів на день, а не довгострокові агентські завдання, зарезервовані для флагмана. Поділ лінійки моделей у такий спосіб, на велику передову версію та швидку, дешеву супутню, став стандартною ідеєю серед китайських лабораторій, які змагаються за розум розробників.

Доставка в переповнене поле

MiniMax не випускає на спокійний ринок. 3 серпня Alibaba випустила Qwen3.8-Max — флагман із 2,4 трильйонами параметрів і ціною 2 долари США за мільйон вхідних токенів — потім 12 серпня випустила першу відкриту версію моделі Qwen рівня Max. GLM-5.3 Zhipu приземлився 14 серпня з власним контекстним вікном у мільйон токенів.

Розробники помітили потік потужних, недорогих варіантів. Згідно зі звітом CNBC про дані OpenRouter, китайські моделі становили від 57% до 67% від загального використання токенів на платформі протягом тижня, який включав 14 вересня — порівняно з лише 6% до 13% у лютому. Подібний стрибок спостерігався у Vercel: у серпні частка використання китайських моделей на його платформі зросла до 55%.

Вашингтон спостерігає

Сплеск привернув увагу далеко за межами спільнот розробників. Деніел Ремлер, старший науковий співробітник програми технологій і національної безпеки в Центрі нової американської безпеки, сказав CNBC, що китайський штучний інтелект представляє «реальні ризики для економіки та безпеки для Сполучених Штатів», застерігши від інтеграції китайських моделей у критичні робочі процеси.

Така ретельна перевірка додає рівень складності тихій версії MiniMax. Модель, яка надходить без картки моделі, опублікованих оцінок або цін, дає незалежним розробникам менше праці для оцінки якості та безпеки — навіть якщо продукти лабораторії отримують реальну частку використання порівняно з американськими конкурентами.

Чому тихий запуск може бути стратегічним

Моделі попереднього перегляду, розміщені у власному продукті компанії, є знайомою схемою: вони генерують дані про використання та відгуки перед ширшим випуском API, водночас обмежуючи вплив, якщо модель не працює. Для MiniMax приглушений дебют M3.1-Flash-Preview також може бути способом привернути увагу до більшого запуску — згідно зі звітом, цитованим Startup Fortune, компанія збільшила продажі більш ніж удвічі, оскільки готує нову флагманську модель.

Для розробників практичний висновок простий: новий рівень швидкого кодування від однієї з провідних лабораторій Китаю зараз працює всередині MiniMax Code, а контрольні показники та ціни, які зазвичай ґрунтуються на такому випуску, досі відсутні. Чи зможе M3.1-Flash-Preview розширити імпульс, завдяки якому китайські моделі отримали більшу частку трафіку OpenRouter, залежатиме від того, як він працюватиме, коли розробники почнуть проштовхувати через нього реальні робочі навантаження.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →