O laboratório chinês de IA MiniMax adotou uma abordagem incomum em seu último lançamento: mal reconheceu isso. Em 27 de setembro, a conta oficial da empresa confirmou o que os desenvolvedores já haviam visto no produto – um novo modelo chamado M3.1-Flash-Preview foi lançado dentro do MiniMax Code, o assistente de codificação da empresa. Essa foi a extensão do lançamento: nenhum modelo de cartão, nenhuma tabela de benchmark, nenhum preço por milhão de tokens.

Os observadores chineses de IA no X notaram que o modelo apareceu no produto antes da confirmação, de acordo com a Startup Fortune. O lançamento silencioso é um contraste marcante com a forma como o MiniMax lançou seu último carro-chefe. Para mais contexto sobre esta história, confira nossa últimos desenvolvimentos em IA.

Uma estreia deliberadamente silenciosa

Quando a MiniMax lançou o M3 em junho, a empresa publicou detalhes da arquitetura, pontuações do SWE-bench e uma tabela de preços que superou os rivais em 90%. Desta vez, o endpoint da API para M3.1-Flash-Preview está bloqueado, e a única maneira de testar o modelo é dentro do próprio produto do MiniMax, com traços de raciocínio e comportamento como os principais sinais observáveis.

A estratégia discreta sugere que o MiniMax pode estar tratando o lançamento menos como um lançamento de manchete e mais como um experimento: testes A/B de um recurso de produto e deixar a Internet descobrir. Isso pode refletir a confiança de que o modelo falará por si assim que os desenvolvedores o usarem – ou simplesmente que esta versão não é a grande, mas uma camada complementar mais rápida e barata.

O que a Base M3 nos diz

O modelo básico M3 oferece uma ideia do que o MiniMax pode oferecer quando precisa de atenção. É um modelo de mistura de especialistas de 428 bilhões de parâmetros com aproximadamente 23 bilhões de parâmetros ativos por token, uma janela de contexto de um milhão de tokens e entrada nativa de imagem e vídeo. No SWE-bench Verified, MiniMax relatou uma pontuação de 80,5%.

Flash é a versão da linha criada para aprimorar a vantagem de velocidade e preço para a codificação diária – as correções rápidas de bugs e os pequenos desenvolvedores de trabalho de recursos são executados dezenas de vezes por dia, em vez das tarefas de agente de longo prazo reservadas para o carro-chefe. Dividir uma linha de modelos dessa maneira, com uma versão de grande porte e um companheiro rápido e barato, tornou-se o manual padrão entre os laboratórios chineses que competem pela participação dos desenvolvedores.

Envio para um campo lotado

MiniMax não está lançando em um mercado tranquilo. O Alibaba lançou o Qwen3.8-Max em 3 de agosto – um carro-chefe de 2,4 trilhões de parâmetros com preço de US$ 2 por milhão de tokens de entrada – e em 12 de agosto lançou a primeira versão de peso aberto de um modelo Qwen de nível Max. O GLM-5.3 da Zhipu chegou em 14 de agosto com uma janela de contexto própria de um milhão de tokens.

Os desenvolvedores notaram a enxurrada de opções eficientes e baratas. De acordo com relatórios da CNBC sobre dados do OpenRouter, os modelos chineses representaram 57% a 67% do uso total de tokens na plataforma na semana que incluiu 14 de setembro – acima dos 6% a 13% em fevereiro. A Vercel viu um salto semelhante, com a participação dos modelos chineses em sua plataforma subindo para 55% em agosto.

Washington está assistindo

O aumento atraiu a atenção muito além das comunidades de desenvolvedores. Daniel Remler, pesquisador sênior do programa de tecnologia e segurança nacional do Centro para uma Nova Segurança Americana, disse à CNBC que a IA chinesa representa “riscos reais econômicos e de segurança para os Estados Unidos”, alertando contra a integração de modelos chineses em fluxos de trabalho críticos.

Esse escrutínio adiciona uma camada de complexidade ao lançamento silencioso do MiniMax. Um modelo que chega sem cartão de modelo, avaliações publicadas ou preços dá aos desenvolvedores independentes menos trabalho para avaliar a qualidade e a segurança - mesmo que os produtos do laboratório ganhem participação real no uso em relação aos rivais americanos.

Por que o lançamento silencioso pode ser estratégico

Os modelos de visualização contidos no produto da própria empresa são um padrão familiar: eles geram dados de uso e feedback antes de um lançamento mais amplo da API, ao mesmo tempo que limitam a exposição se o modelo apresentar desempenho inferior. Para o MiniMax, a estreia silenciosa do M3.1-Flash-Preview também pode ser uma forma de manter os holofotes para um lançamento maior – a empresa mais que dobrou as vendas enquanto prepara um novo modelo carro-chefe, de acordo com reportagem citada pela Startup Fortune.

Para os desenvolvedores, a conclusão prática é simples: um novo nível de codificação rápida de um dos principais laboratórios da China já está disponível no MiniMax Code, e os benchmarks e preços que normalmente enquadrariam tal lançamento ainda estão faltando. Se o M3.1-Flash-Preview pode estender o impulso que levou os modelos chineses a uma parcela majoritária do tráfego do OpenRouter dependerá de seu desempenho quando os desenvolvedores começarem a enviar cargas de trabalho reais através dele.

---

Fique à Frente da IA

As últimas notícias, análises e avanços em inteligência artificial — tudo em um só lugar.

Ler mais notícias de IA →