Китайская лаборатория искусственного интеллекта MiniMax применила необычный подход к своей последней версии: она почти не признала это. 27 сентября официальный аккаунт компании подтвердил то, что разработчики уже заметили в продукте — новая модель под названием M3.1-Flash-Preview была запущена в MiniMax Code, помощнике по программированию компании. Вот и весь запуск: ни карты модели, ни таблицы эталонов, ни цены за миллион токенов.

По данным Startup Fortune, китайские наблюдатели за искусственным интеллектом на X заметили, что модель появилась в продукте еще до подтверждения. Выпуск приглушенного звука разительно контрастирует с тем, как MiniMax выпустила свой последний флагман. Подробнее об этой истории — в нашем больше статей об ИИ.

Нарочито тихий дебют

Когда MiniMax запустила M3 в июне, компания опубликовала подробности архитектуры, результаты тестов SWE и прайс-лист, которые обогнали конкурентов на 90%. На этот раз конечная точка API для M3.1-Flash-Preview закрыта, и единственный способ опробовать модель — внутри собственного продукта MiniMax, где в качестве основных наблюдаемых сигналов используются следы рассуждений и поведение.

Сдержанная стратегия предполагает, что MiniMax, возможно, будет относиться к выпуску не как к запуску заголовка, а скорее как к эксперименту: A/B-тестирование функции продукта и предоставление возможности Интернету узнать об этом. Это может отражать уверенность в том, что модель заговорит сама за себя, как только разработчики ее начнут использовать, или просто в том, что эта версия не самая большая, а более быстрая и дешевая сопутствующая версия.

Что говорит нам база M3

Базовая модель M3 дает представление о том, что может предложить MiniMax, когда он действительно требует внимания. Это смешанная экспертная модель с 428 миллиардами параметров, примерно с 23 миллиардами активных параметров на токен, контекстным окном в один миллион токенов и собственным входом изображений и видео. По данным SWE-bench Verified, MiniMax показал результат 80,5%.

Flash — это версия линейки, созданная для того, чтобы заострить преимущество в скорости и цене для повседневного кодирования — быстрые исправления ошибок и небольшие функции, которые разработчики выполняют десятки раз в день, а не долгосрочные агентские задачи, зарезервированные для флагмана. Такое разделение модельного ряда с использованием крупной передовой версии и быстрого и дешевого компаньона стало стандартной практикой среди китайских лабораторий, конкурирующих за долю разработчиков.

Доставка в многолюдное поле

MiniMax не выходит на тихий рынок. 3 августа Alibaba выпустила Qwen3.8-Max — флагман с 2,4 триллиона параметров по цене 2 доллара за миллион входных токенов, а 12 августа последовала первая открытая версия модели Qwen уровня Max. GLM-5.3 от Zhipu появился 14 августа с собственным контекстным окном на миллион токенов.

Разработчики заметили поток функциональных и недорогих вариантов. Согласно отчету CNBC о данных OpenRouter, на китайские модели приходилось от 57% до 67% общего использования токенов на платформе за неделю, включая 14 сентября, — по сравнению с 6% до 13% в феврале. Аналогичный скачок наблюдался и у Vercel: в августе доля использования китайских моделей на ее платформе выросла до 55%.

Вашингтон наблюдает

Этот всплеск привлек внимание далеко за пределами сообществ разработчиков. Дэниел Ремлер, старший научный сотрудник программы технологий и национальной безопасности Центра новой американской безопасности, рассказал CNBC, что китайский ИИ представляет «реальные риски для экономики и безопасности для Соединенных Штатов», предостерегая от интеграции китайских моделей в критически важные рабочие процессы.

Это исследование добавляет сложности тихому выпуску MiniMax. Модель, которая поставляется без карточки модели, опубликованных оценок или цен, дает независимым разработчикам меньше возможностей для работы при оценке качества и безопасности - даже несмотря на то, что продукты лаборатории получают реальную долю использования по сравнению с американскими конкурентами.

Почему тихий запуск может быть стратегическим

Предварительные модели, встроенные в собственный продукт компании, представляют собой знакомую модель: они генерируют данные об использовании и обратную связь перед более широким выпуском API, одновременно ограничивая воздействие, если модель неэффективна. Для MiniMax приглушенный дебют M3.1-Flash-Preview также может стать способом привлечь внимание к более масштабному запуску — согласно отчету, цитируемому Startup Fortune, продажи компании выросли более чем вдвое, поскольку она готовит новую флагманскую модель.

Для разработчиков практический вывод прост: новый уровень быстрого кодирования от одной из ведущих лабораторий Китая теперь доступен внутри MiniMax Code, а тесты и цены, которые обычно определяют такой выпуск, все еще отсутствуют. Сможет ли M3.1-Flash-Preview продлить импульс, который позволил китайским моделям занять большую часть трафика OpenRouter, будет зависеть от того, как он будет работать, когда разработчики начнут проталкивать через него реальные рабочие нагрузки.

---

Будьте в курсе ИИ

Последние новости, аналитика и прорывы в сфере ИИ — всё в одном месте.

Читать больше новостей об ИИ →