Meituan, le conglomérat technologique chinois connu internationalement pour son empire de livraison de nourriture, a publié et open source LongCat-2.0, un modèle d'intelligence artificielle de 1,6 billion de paramètres spécialement conçu pour l'ingénierie logicielle agentique. La version, annoncée le 30 juin 2026, est remarquable non seulement par son ampleur mais aussi par la manière dont elle a été formée : entièrement sur des puces chinoises produites dans le pays, sans aucun accélérateur Nvidia ou AMD en préparation.
Cette décision est interprétée comme le signal le plus fort à ce jour selon lequel les contrôles américains sur les exportations de silicium d’IA avancé ne parviennent pas à empêcher les entreprises chinoises de produire des modèles de classe frontière. Plusieurs médias, dont le South China Morning Post, Reuters et VentureBeat, ont rapporté le lancement, Crypto Briefing décrivant LongCat-2.0 comme l'un des plus grands modèles de codage open source jamais construits. Pour plus de contexte sur cette histoire, consultez notre couverture de l'industrie de l'IA.
Un modèle mixte d'experts conçu pour les agents
LongCat-2.0 utilise une architecture de mélange d'experts (MoE), ce qui signifie qu'il n'active pas les 1 600 milliards de paramètres à chaque requête. Au lieu de cela, il achemine dynamiquement chaque jeton à travers environ 33 à 56 milliards de paramètres actifs, ce qui le rend beaucoup plus efficace qu'un modèle dense de taille comparable tout en conservant une vaste base de connaissances sur laquelle s'appuyer.
Cette efficacité compte pour le coût. Les conceptions MoE sont devenues l'architecture dominante pour les modèles à grande échelle, précisément parce qu'elles dissocient la capacité totale du calcul par requête, permettant aux laboratoires de livrer de très grands modèles sans facturer aux clients chaque paramètre de chaque appel.
Le modèle prend en charge une fenêtre contextuelle de 1 million de jetons, suffisamment grande pour ingérer une base de code entière et la raisonner en un seul passage — une capacité de plus en plus demandée par les agents de codage autonomes qui doivent garder à l'esprit des référentiels entiers plutôt que de travailler fichier par fichier.
Benchmarks et utilisation dans le monde réel
Sur les benchmarks conçus pour mesurer l'ingénierie logicielle du monde réel, LongCat-2.0 a affiché un score de 59,5 sur SWE-bench Pro et de 70,8 sur Terminal-Bench, selon Crypto Briefing. Ces suites d'évaluation testent dans quelle mesure les modèles gèrent les défis compliqués et en plusieurs étapes d'un véritable travail de développement (correction de bogues, écriture de fonctionnalités, navigation dans le code existant) plutôt que de simples énigmes de programmation ponctuelles.
VentureBeat a noté séparément que le modèle était « en tête d'OpenRouter », la passerelle API multimodèle populaire, dans le classement du codage agent avant sa sortie officielle open source. OpenRouter regroupe plus de 400 modèles provenant de plus de 60 fournisseurs et ses données d'utilisation sont largement traitées comme un baromètre industriel des modèles que les développeurs choisissent réellement d'exécuter.
Formé sur 50 000 jetons nationaux
Le détail qui retient le plus l’attention est le matériel. Meituan a déclaré avoir formé et exécuté LongCat-2.0 sur un cluster de calcul national de 50 000 cartes entièrement construit à partir d'accélérateurs fabriqués en Chine. Selon Crypto Briefing, cela signifie qu'aucun Nvidia A100 ou H100 et aucune unité AMD MI300X n'ont été utilisés à aucun stade de la formation – une rupture nette avec le matériel qui a alimenté la plupart des développements de grands modèles dans le monde.
Meituan affirme que le cluster de 50 000 cartes représente une première à cette échelle pour le matériel chinois. La formation a été achevée malgré les contrôles américains à l'exportation qui ont systématiquement restreint l'accès de la Chine aux puces d'IA de pointe depuis fin 2022. L'implication, selon les analystes, est que l'effet de levier des contrôles s'érode à mesure que les fabricants de puces chinois et leurs clients réduisent l'écart de performance.
Poids disponibles sur Hugging Face
Conformément au cadre open source, Meituan a publié les poids du modèle et les ressources de support sur Hugging Face sous l'organisation « meituan-longcat ». Cela réduit les obstacles pour les développeurs et les chercheurs qui souhaitent affiner le modèle pour les bases de code d'entreprise, l'audit de sécurité ou le débogage automatisé, mais qui ne pourraient jamais se permettre de former quelque chose de comparable à partir de zéro.
La version ouverte alimente également directement l'écosystème de codage agent, où les modèles à pondération ouverte peuvent être auto-hébergés, audités et modifiés sans les coûts par jeton et les problèmes de gestion des données qui accompagnent les API propriétaires – une considération importante pour les entreprises qui hésitent à envoyer du code propriétaire à un cloud tiers.
Une lignée de modèles rapide
LongCat-2.0 n’est pas apparu du jour au lendemain. La lignée remonte à LongCat-Flash, un modèle de 560 milliards de paramètres publié en septembre 2025, suivi de LongCat-Next, une variante multimodale, en mars 2026. La nouvelle version triple presque le nombre de paramètres de son prédécesseur en moins d'un an, reflétant le rythme effréné auquel les laboratoires chinois itèrent désormais sur les modèles de base.
Le lancement intervient également dans le cadre d'un remaniement plus large du classement mondial des modèles, dans lequel les systèmes chinois ont augmenté dans l'utilisation réelle des développeurs et sont désormais en tête du classement de la consommation de jetons sur les plates-formes d'agrégation.
Ce que cela signifie pour le débat sur le contrôle des puces
Pour les décideurs politiques de Washington, LongCat-2.0 est un point de données inconfortable. Le principe central de la stratégie de contrôle des exportations est que refuser l’accès aux puces de pointe ralentirait les progrès de la Chine en matière d’IA. Chaque modèle formé avec succès sur du matériel domestique affaiblit cette prémisse, suggérant que les restrictions pourraient accélérer l’autosuffisance qu’elles étaient censées empêcher.
Meituan elle-même a adopté un ton public mesuré. Le fondateur et directeur général Wang Xing a récemment réitéré l'engagement de l'entreprise en faveur des investissements dans l'IA tout en soulignant qu'elle n'investirait pas « aveuglément au-delà de sa capacité financière », selon des informations publiées par Futu.
Pour l’instant, les conclusions à retenir pour les développeurs sont concrètes : un modèle de codage proche de la frontière, d’un million de jetons, est téléchargeable gratuitement et il a été construit sans une seule puce américaine restreinte. Que les laboratoires américains réagissent avec des poids ouverts moins chers, des contrôles plus stricts ou une nouvelle poussée en faveur des performances brutes, le paysage concurrentiel vient de changer à nouveau.
---
Restez à la Pointe de l'IALes dernières actualités, analyses et percées en IA — au même endroit.
Lire plus d'actualités IA →



