El laboratorio chino de IA Moonshot AI presentó Kimi K3 el 16 de julio de 2026, lanzando lo que llama "el primer modelo abierto de clase 3T del mundo": un sistema de 2,8 billones de parámetros que reduce la brecha con los modelos patentados más potentes de Anthropic y OpenAI. El lanzamiento se convirtió inmediatamente en uno de los lanzamientos de IA más comentados del año, alcanzando la cima de Hacker News y atrayendo cobertura de Reuters, Bloomberg y The New York Times.
Para la [cobertura de la industria de la IA] más amplia (https://aibuzzwire.news), Kimi K3 es importante porque eleva considerablemente la frontera de los modelos abiertos, al tiempo que obliga a un nuevo debate sobre si los sistemas descargables gratuitamente pueden igualar a los cerrados. Moonshot dice que los pesos completos del modelo se publicarán antes del 27 de julio de 2026.
Un modelo abierto de 2,8 billones de parámetros
Según el anuncio técnico de Moonshot, Kimi K3 es un modelo de 2,8 billones de parámetros construido sobre dos actualizaciones arquitectónicas que la compañía llama Kimi Delta Attention (KDA) y Attention Residuals (AttnRes). Utiliza un diseño de Mezcla de Expertos (MoE) que activa solo 16 de 896 expertos para cualquier token determinado, junto con lo que Moonshot describe como un marco Stable LatentMoE. La compañía afirma que estos cambios producen aproximadamente una mejora de 2,5 veces en la eficiencia de escalado general en comparación con su modelo Kimi K2 anterior.
El modelo también viene con capacidades de visión nativas y una ventana de contexto de un millón de tokens. El analista Simon Willison, escribiendo en su blog, señaló que Kimi K3 toma la corona de tamaño abierto del v4 Pro de 1,6 billones de parámetros de DeepSeek: "más del doble del tamaño" del Kimi K2.6 de 1 billón de parámetros que lo precedió.
Moonshot enmarca el lanzamiento como el último paso en un impulso de escala sostenido, diciendo que durante nueve de los últimos doce meses sus modelos han establecido el límite superior de los tamaños de modelos abiertos.
Cómo se compara con los puntos de referencia
El propio conjunto de evaluación de Moonshot coloca el rendimiento general de Kimi K3 detrás de solo dos sistemas propietarios: Claude Fable 5 de Anthropic y GPT-5.6 Sol de OpenAI, mientras que supera consistentemente a otros modelos probados, incluidos Claude Opus 4.8 y GPT-5.5. El análisis de terceros rastrea ampliamente esas afirmaciones.
El servicio de evaluación independiente Artificial Analysis informó que en su punto de referencia privado de trabajo de conocimiento a largo plazo, Kimi K3 alcanzó un Elo general de 1547, un salto de 732 puntos sobre Kimi K2.6 y solo detrás de Claude Fable 5. En la arena Frontend Code de Arena.ai, Kimi K3 subió al puesto número uno, superando incluso a Claude Fable 5, según una publicación en la tabla de clasificación que circuló ampliamente después del lanzamiento.
El precio es una parte notable de la historia. Artificial Analysis fijó el costo promedio por tarea en $0,94, comparable a los $1,04 de GPT-5.6 Sol y aproximadamente la mitad de los $1,80 de Claude Opus 4.8, al tiempo que señaló que Kimi K3 usó un 21% menos de tokens de salida que su predecesor. Por token, el modelo tiene un precio de 3 dólares por millón de tokens de entrada y 15 dólares por millón de tokens de salida, el mismo nivel que la serie Claude Sonnet de Anthropic y, como observó Willison, el modelo más caro lanzado por un laboratorio de IA chino hasta la fecha, frente a los 0,95 dólares/4 dólares de Kimi K2.6.
Codificación agente y un compilador que él mismo construyó
Gran parte del anuncio de Moonshot no se centró en los puntos de referencia de los chatbots sino en tareas de agencia a largo plazo. La compañía dice que Kimi K3 puede sostener sesiones de ingeniería extendidas, navegar por grandes repositorios de código y orquestar herramientas de terminal con una mínima supervisión humana.
En una demostración, Moonshot dijo que una versión inicial de Kimi K3 manejó la mayor parte del trabajo de optimización del kernel de GPU del propio equipo durante la última etapa del desarrollo. En otro, el modelo construyó "MiniTriton", un compilador de GPU compacto similar a Triton con su propia representación intermedia a nivel de mosaico, pases de optimización y canal de generación de código PTX. Moonshot afirma que MiniTriton igualó o superó las pilas establecidas de Triton y torch.compile en los puntos de referencia de la línea del techo admitidos y en el entrenamiento nanoGPT sostenido de extremo a extremo con convergencia estable.
La empresa también presentó una sorprendente prueba de concepto en el diseño de chips. En una sola ejecución autónoma de 48 horas, Kimi K3 supuestamente diseñó, optimizó y verificó un chip construido para servir a un nanomodelo en su propia arquitectura, utilizando herramientas EDA de código abierto en la biblioteca Nangate de 45 nm. Moonshot dijo que el diseño cierra el tiempo a 100 MHz dentro de 4 mm² y mantiene más de 8700 tokens por segundo de rendimiento de decodificación en simulación.
En cuanto a la investigación, Moonshot dijo que Kimi K3 reprodujo las relaciones universales I-Love-Q de la astrofísica computacional en aproximadamente dos horas (trabajo que la compañía estimó que normalmente llevaría a un investigador de una a dos semanas) mediante la validación cruzada de más de 20 artículos, implementando un proceso numérico completo a través de más de 300 ecuaciones de estado y escribiendo más de 3000 líneas de Python.
Vuelve el debate sobre el peso abierto
La llegada de Kimi K3 reaviva un debate que se ha prolongado hasta 2026, ya que los laboratorios chinos han acortado (o han parecido acortar) repetidamente la distancia con los modelos fronterizos de Estados Unidos. El patrón ahora es familiar: un comunicado chino publica cifras autoinformadas cerca de la cima de las tablas de clasificación, los laboratorios occidentales enfatizan su ventaja patentada aún creciente y las empresas sopesan el costo y la apertura frente a la capacidad bruta.
Esa tensión es visible en los precios. Un modelo que socava el costo por tarea de Claude Opus 4.8 mientras se acerca a su capacidad, pero que cobra más que cualquier versión china anterior, refleja la confianza de Moonshot en que puede obtener precios superiores incluso en un ecosistema abierto. Willison advirtió que no se debe leer demasiado en un solo punto de referencia (su prueba de larga duración "pelícano en bicicleta", escribió, ya no se correlaciona de manera confiable con la calidad del mundo real), pero dijo que el lanzamiento aún recompensaba las pruebas prácticas.
Kimi K3 ya está disponible a través de Kimi.com, el agente de escritorio Kimi Work, la herramienta de desarrollo Kimi Code y la API Kimi. Moonshot dijo que está trabajando con socios de inferencia y mantenedores de código abierto para garantizar una implementación confiable antes del lanzamiento completo.
Manténgase por delante de la IA
Para obtener cobertura continua sobre lanzamientos de modelos, batallas de referencia y la frontera del peso abierto, siga AI Buzz Wire para conocer los desarrollos que dan forma a la carrera global de inteligencia artificial.
Leer más noticias sobre modelos de IA →


