Le laboratoire chinois d'IA Moonshot AI a dévoilé le Kimi K3 le 16 juillet 2026, lançant ce qu'il appelle « le premier modèle ouvert de classe 3T au monde » – un système de 2,8 billions de paramètres qui réduit l'écart avec les modèles propriétaires les plus puissants d'Anthropic et d'OpenAI. Le lancement est immédiatement devenu l’une des versions d’IA les plus discutées de l’année, atteignant le sommet de Hacker News et bénéficiant d’une couverture médiatique de Reuters, Bloomberg et du New York Times.
Pour une couverture plus large de l'industrie de l'IA, Kimi K3 est important car il repousse nettement plus haut la frontière des modèles ouverts tout en forçant un nouveau débat sur la question de savoir si les systèmes téléchargeables gratuitement peuvent correspondre aux systèmes fermés. Moonshot indique que les poids complets du modèle seront publiés d'ici le 27 juillet 2026.
Un modèle ouvert de 2,8 billions de paramètres
Selon l'annonce technique de Moonshot, Kimi K3 est un modèle de 2,8 billions de paramètres construit sur deux mises à jour architecturales que la société appelle Kimi Delta Attention (KDA) et Attention Residuals (AttnRes). Il utilise une conception de mélange d'experts (MoE) qui n'active que 16 des 896 experts pour un jeton donné, associé à ce que Moonshot décrit comme un cadre LatentMoE stable. La société affirme que ces changements entraînent une amélioration d’environ 2,5 fois de l’efficacité globale de mise à l’échelle par rapport à son précédent modèle Kimi K2.
Le modèle est également livré avec des capacités de vision natives et une fenêtre contextuelle d'un million de jetons. L'analyste Simon Willison, écrivant sur son blog, a noté que Kimi K3 remporte la couronne de taille ouverte du v4 Pro de DeepSeek, doté de 1,6 billion de paramètres, soit "plus de deux fois la taille" du Kimi K2.6 de 1 billion de paramètres qui l'a précédé.
Moonshot considère cette sortie comme la dernière étape d'une démarche de mise à l'échelle soutenue, affirmant qu'au cours de neuf des douze derniers mois, ses modèles ont fixé la limite supérieure des tailles de modèles ouverts.
Comment cela se compare-t-il aux benchmarks
La propre suite d'évaluation de Moonshot place les performances globales de Kimi K3 derrière seulement deux systèmes propriétaires – Claude Fable 5 d'Anthropic et GPT-5.6 Sol d'OpenAI – tout en surclassant systématiquement les autres modèles testés, notamment Claude Opus 4.8 et GPT-5.5. L’analyse tierce suit largement ces affirmations.
Le service d'évaluation indépendant Artificial Analysis a rapporté que sur son benchmark privé de travail de connaissances à long terme, Kimi K3 a atteint un Elo global de 1547 – un bond de 732 points par rapport à Kimi K2.6 et derrière seulement Claude Fable 5. Sur l'arène Frontend Code d'Arena.ai, Kimi K3 s'est hissé à la première place, surpassant même Claude Fable 5, selon un message de classement qui a largement circulé après le lancement.
Le prix est une partie notable de l’histoire. L'analyse artificielle a fixé le coût moyen par tâche à 0,94 $, comparable aux 1,04 $ de GPT-5.6 Sol et à environ la moitié des 1,80 $ de Claude Opus 4.8, tout en notant que Kimi K3 utilisait 21 % de jetons de sortie en moins que son prédécesseur. Sur une base par jeton, le modèle est au prix de 3 $ par million de jetons d'entrée et de 15 $ par million de jetons de sortie – le même niveau que la série Claude Sonnet d'Anthropic et, comme l'a observé Willison, le modèle le plus cher publié par un laboratoire d'IA chinois à ce jour, contre 0,95 $/4 $ de Kimi K2.6.
Codage agent et compilateur construit lui-même
Une grande partie de l'annonce de Moonshot ne s'est pas concentrée sur les tests de chatbot mais sur les tâches d'agent à long terme. La société affirme que Kimi K3 peut supporter des sessions d'ingénierie prolongées, naviguer dans de grands référentiels de code et orchestrer des outils de terminal avec une surveillance humaine minimale.
Dans une démonstration, Moonshot a déclaré qu'une première version de Kimi K3 gérait la majorité du travail d'optimisation du noyau GPU de l'équipe au cours des dernières étapes du développement. Dans un autre, le modèle a construit « MiniTriton », un compilateur GPU compact de type Triton avec sa propre représentation intermédiaire au niveau des tuiles, des passes d'optimisation et un pipeline de génération de code PTX. Moonshot affirme que MiniTriton a égalé ou battu les piles Triton et torch.compile établies sur les références de ligne de toit prises en charge et une formation nanoGPT soutenue de bout en bout avec une convergence stable.
La société a également présenté une preuve de concept frappante en matière de conception de puces. En une seule exécution autonome de 48 heures, Kimi K3 aurait conçu, optimisé et vérifié une puce conçue pour servir un modèle nano sur sa propre architecture, à l'aide d'outils EDA open source sur la bibliothèque Nangate 45 nm. Moonshot a déclaré que la conception ferme la synchronisation à 100 MHz dans un rayon de 4 mm² et prend en charge plus de 8 700 jetons par seconde de débit de décodage en simulation.
Du côté de la recherche, Moonshot a déclaré que Kimi K3 avait reproduit les relations universelles I-Love-Q issues de l'astrophysique computationnelle en environ deux heures – un travail qui, selon l'entreprise, prendrait généralement une à deux semaines à un chercheur – en validant de manière croisée plus de 20 articles, en mettant en œuvre un pipeline numérique complet sur plus de 300 équations d'état et en écrivant plus de 3 000 lignes de Python.
Le débat ouvert revient
L'arrivée de Kimi K3 relance un débat qui a duré jusqu'en 2026, alors que les laboratoires chinois ont réduit à plusieurs reprises – ou ont semblé réduire – la distance avec les modèles frontières américains. Le schéma est désormais familier : un communiqué chinois publie des chiffres autodéclarés en haut des classements, les laboratoires occidentaux soulignent leur avantage propriétaire toujours croissant, et les entreprises mettent en balance les coûts et l'ouverture par rapport aux capacités brutes.
Cette tension est visible dans la tarification. Un modèle qui réduit le coût par tâche de Claude Opus 4.8 tout en approchant de ses capacités, mais qui coûte plus cher que n'importe quelle version chinoise précédente, reflète la confiance de Moonshot dans sa capacité à obtenir des prix plus élevés, même dans un écosystème ouvert. Willison a mis en garde contre une lecture excessive d'un seul benchmark - son test de longue date "Pélican sur un vélo", écrit-il, ne correspond plus de manière fiable à la qualité du monde réel - mais a déclaré que la publication récompensait toujours les tests pratiques.
Kimi K3 est désormais disponible via Kimi.com, l'agent de bureau Kimi Work, l'outil de développement Kimi Code et l'API Kimi. Moonshot a déclaré qu'il travaillait avec des partenaires d'inférence et des mainteneurs open source pour garantir un déploiement fiable avant la publication des poids complets.
Gardez une longueur d'avance sur l'IA
Pour une couverture continue des sorties de modèles, des batailles de référence et de la frontière des poids ouverts, suivez AI Buzz Wire pour les développements qui façonnent la course mondiale à l'intelligence artificielle.
Lire plus d'actualités sur les modèles d'IA →


