El laboratorio chino de IA MiniMax ha adoptado un enfoque inusual en su último lanzamiento: apenas lo reconoció. El 27 de septiembre, la cuenta oficial de la compañía confirmó lo que los desarrolladores ya habían detectado en el producto: un nuevo modelo llamado M3.1-Flash-Preview se había activado dentro de MiniMax Code, el asistente de codificación de la compañía. Ese fue el alcance del lanzamiento: sin tarjeta modelo, sin tabla de referencia, sin precio por millón de tokens.
Los observadores chinos de IA en X habían notado que el modelo aparecía en el producto antes de la confirmación, según Startup Fortune. El lanzamiento silencioso contrasta sorprendentemente con la forma en que MiniMax envió su último buque insignia. Para más contexto sobre esta historia, consulta nuestra últimos avances en IA.
Un debut deliberadamente silencioso
Cuando MiniMax lanzó M3 en junio, la compañía publicó detalles de arquitectura, puntuaciones de SWE-bench y una hoja de precios que rebajaba a sus rivales en un 90%. Esta vez, el punto final API para M3.1-Flash-Preview está cerrado y la única forma de probar el modelo es dentro del propio producto de MiniMax, con rastros de razonamiento y comportamiento como principales señales observables.
La estrategia discreta sugiere que MiniMax puede estar tratando el lanzamiento menos como un lanzamiento titular y más como un experimento: prueba A/B de una característica del producto y dejar que Internet lo descubra. Eso podría reflejar confianza en que el modelo hablará por sí solo una vez que los desarrolladores lo utilicen, o simplemente que esta versión no es la más importante, sino un nivel complementario más rápido y económico.
Lo que nos dice la Base M3
El modelo básico M3 ofrece una idea de lo que MiniMax puede ofrecer cuando necesita atención. Es un modelo de combinación de expertos de 428 mil millones de parámetros con aproximadamente 23 mil millones de parámetros activos por token, una ventana de contexto de un millón de tokens y entrada nativa de imágenes y videos. En SWE-bench Verified, MiniMax obtuvo una puntuación del 80,5%.
Flash es la versión de la línea creada para mejorar esa velocidad y ventaja de precio para la codificación diaria: las correcciones rápidas de errores y el trabajo de pequeñas funciones que los desarrolladores ejecutan docenas de veces al día, en lugar de las tareas de agente de largo plazo reservadas para el buque insignia. Dividir una línea de modelos de esta manera, con una versión de gran frontera y un compañero rápido y barato, se ha convertido en el manual estándar entre los laboratorios chinos que compiten por la participación de los desarrolladores.
Envío a un campo abarrotado
MiniMax no se lanzará a un mercado tranquilo. Alibaba lanzó Qwen3.8-Max el 3 de agosto, un buque insignia de 2,4 billones de parámetros con un precio de 2 dólares por millón de tokens de entrada, y luego, el 12 de agosto, lanzó la primera versión abierta de un modelo Qwen de nivel Max. El GLM-5.3 de Zhipu aterrizó el 14 de agosto con una ventana de contexto propia de un millón de tokens.
Los desarrolladores han notado la avalancha de opciones potentes y económicas. Según los informes de CNBC sobre los datos de OpenRouter, los modelos chinos representaron entre el 57% y el 67% del uso total de tokens en la plataforma durante la semana que incluyó el 14 de septiembre, frente a solo el 6% y el 13% en febrero. Vercel experimentó un salto similar: la participación de uso de modelos chinos en su plataforma aumentó al 55% en agosto.
Washington está mirando
El aumento ha atraído la atención mucho más allá de las comunidades de desarrolladores. Daniel Remler, investigador principal del programa de tecnología y seguridad nacional del Centro para una Nueva Seguridad Estadounidense, dijo a CNBC que la IA china representa "riesgos económicos y de seguridad reales para Estados Unidos", advirtiendo contra la integración de modelos chinos en flujos de trabajo críticos.
Ese escrutinio añade una capa de complejidad al silencioso lanzamiento de MiniMax. Un modelo que llega sin una tarjeta modelo, evaluaciones publicadas o precios les da a los desarrolladores independientes menos con qué trabajar al evaluar la calidad y la seguridad, incluso cuando los productos del laboratorio ganan una participación de uso real frente a sus rivales estadounidenses.
Por qué el lanzamiento silencioso puede ser estratégico
Los modelos de vista previa incluidos dentro del propio producto de una empresa son un patrón familiar: generan datos de uso y comentarios antes de un lanzamiento más amplio de API, al tiempo que limitan la exposición si el modelo tiene un rendimiento inferior. Para MiniMax, el discreto debut de M3.1-Flash-Preview también puede ser una forma de mantener la atención para un lanzamiento más grande: la compañía ha más que duplicado sus ventas mientras prepara un nuevo modelo insignia, según un informe citado por Startup Fortune.
Para los desarrolladores, la conclusión práctica es simple: un nuevo nivel de codificación rápida de uno de los laboratorios líderes de China ya está disponible dentro de MiniMax Code, y aún faltan los puntos de referencia y los precios que normalmente enmarcarían dicho lanzamiento. Si M3.1-Flash-Preview puede extender el impulso que llevó a los modelos chinos a una participación mayoritaria en el tráfico de OpenRouter dependerá de cómo se desempeñe una vez que los desarrolladores comiencen a impulsar cargas de trabajo reales a través de él.
---
Mantente al Día con la IALas últimas noticias, análisis y avances de inteligencia artificial, en un solo lugar.
Leer más noticias de IA →