Modèles d'IA
30 articles

Moonshot AI arrête les nouveaux abonnements Kimi K3 alors que la demande dépasse la capacité de calcul
Quelques jours après le lancement de Kimi K3, la société chinoise Moonshot AI a suspendu les nouveaux abonnements payants car la demande pour le modèle à poids ouvert a submergé son infrastructure de calcul.

Alibaba lance Qwen3.8-Max avec 2,4 billions de paramètres, affirmant qu'il n'est qu'à la traîne du Fable 5 d'Anthropic
L'équipe Qwen d'Alibaba a dévoilé un aperçu Qwen3.8-Max de 2,4 billions de paramètres, son premier modèle multimodal de mille milliards de paramètres, affirmant qu'il ne traîne que Fable 5 d'Anthropic alors qu'il s'efforce d'émousser l'élan de Kimi K3.
Un consortium allemand lance Soofi S, un modèle ouvert 30B qui dépasse les références anglaises et allemandes
Un consortium allemand a lancé Soofi S 30B-A3B, un modèle MoE hybride formé sur le cloud munichois de Deutsche Telekom qui surpasse les modèles entièrement ouverts sur les références anglaises et allemandes.

Kimi K3 de Moonshot AI : un modèle ouvert de 2,8 billions de paramètres défie Claude et GPT
La société chinoise Moonshot AI a publié Kimi K3, un modèle ouvert de 2,8 billions de paramètres qui ne traîne que Claude Fable 5 et GPT-5.6 Sol et est en tête du Frontend Code Arena.
NVIDIA lance Nemotron 3 Embed, une collection d'intégration ouverte avec un modèle 8B en tête du classement RTEB
La collection ouverte Nemotron 3 Embed de NVIDIA cible la récupération RAG et agentique à l'échelle de la production, avec son point de contrôle 8B classé n°1 sur le benchmark RTEB.
Moonshot AI dévoile Kimi K3, un modèle à poids ouvert de 2,8 billions de paramètres qui défie les meilleurs rivaux américains
La société chinoise Moonshot AI a annoncé Kimi K3, le plus grand modèle à poids ouvert au monde avec 2 800 milliards de paramètres, correspondant presque au GPT-5.6 et au Claude Fable 5 à une fraction du coût.

Les actions d'Alphabet chutent de 4 % alors que Google retarde à nouveau Gemini 3.5 Pro en raison de lacunes en matière de codage
Le modèle phare de Google, Gemini 3.5 Pro, a des mois de retard car les performances de codage ne répondent pas aux objectifs internes, ce qui fait chuter les actions d'Alphabet de 4 % alors que ses rivaux prennent de l'avance.
Thinking Machines de Mira Murati lance Inkling, un modèle d'IA à poids ouvert de 975 milliards de paramètres
Thinking Machines Lab, fondé par Mira Murati, ancienne CTO d'OpenAI, a publié son premier modèle : un modèle ouvert de 975 milliards de paramètres conçu pour la personnalisation par rapport à la domination des références brutes.
Le sol GPT-5.6 d'OpenAI supprime les fichiers utilisateur et les bases de données, suscitant des problèmes de sécurité
Les développeurs signalent que GPT-5.6 Sol supprime des fichiers, des bases de données et des répertoires entiers sans autorisation. La propre carte système d'OpenAI a averti du risque avant le lancement.
Meta lance Muse Spark 1.1 avec une tarification agressive des API, déclenchant une guerre des prix du codage IA
Le premier modèle d'IA payant de Meta, Muse Spark 1.1, fait ses débuts à 1,25 $ par million de jetons d'entrée avec une fenêtre contextuelle de 1 million, sous-cotant OpenAI, Anthropic et xAI sur le marché du codage.
OpenAI lance GPT-Live : des modèles vocaux en duplex intégral qui écoutent et parlent en même temps
Les nouveaux modèles vocaux GPT-Live d'OpenAI permettent à ChatGPT d'écouter et de parler simultanément à l'aide d'une architecture full-duplex. GPT-Live-1 est désormais disponible pour les utilisateurs payants.
Refiant lance Protea, un modèle d'IA de fenêtre contextuelle de 10 millions de jetons, aucune liste d'attente requise
Refiant, fondée en Afrique du Sud, a lancé Protea, une suite de modèles d'IA à contexte long avec une fenêtre contextuelle de 10 millions de jetons disponible immédiatement sans liste d'attente, ciblant les bases de code d'entreprise et les archives réglementaires.
Mistral AI lance Robostral Navigate, son premier modèle robotique pour la navigation de robots à caméra unique
Robostral Navigate de Mistral AI est un modèle 8B qui permet aux robots de naviguer de manière autonome dans des environnements complexes à l'aide d'une seule caméra RVB, atteignant 76,6 % sur le benchmark R2R-CE.
OpenAI obtient le feu vert pour publier GPT-5.6 pour tous le 9 juillet
Le département américain du Commerce a autorisé OpenAI à publier publiquement GPT-5.6 Sol, Terra et Luna le 9 juillet, mettant ainsi fin à des semaines de limites demandées par le gouvernement.
SpaceXAI lance Grok 4.5 dans le cadre d'un effort conjoint avec Cursor, défiant Anthropic et OpenAI
SpaceXAI d'Elon Musk a publié Grok 4.5, un modèle de 1,5 billion de paramètres entraîné avec les données Cursor, revendiquant des performances de classe Opus à moindre coût. Ce lancement marque la première version majeure de xAI sous sa nouvelle marque SpaceXAI.

Meta lance Muse Image, son premier générateur d'images IA interne, sur Instagram et WhatsApp
Meta a lancé Muse Image et Muse Video le 7 juillet 2026, son premier générateur d'images IA interne, intégré à Instagram, WhatsApp et le chatbot Meta AI.

Le Portugal lance Amália, son premier modèle d'IA open source, dans un effort pour la souveraineté européenne de l'IA
Le Portugal a publié Amália, son premier modèle national d'IA open source, conçu pour les Portugais européens en tant qu'infrastructure numérique publique. Voici ce qu'il fait et qui l'a construit.

Le modèle d'IA « Pastèque » de Meta correspond à GPT-5.5 sur les références alors que Zuckerberg signale les retards des agents
Le chef de Meta AI, Alexandr Wang, affirme que le prochain modèle, Watermelon, a rattrapé le GPT-5.5 d'OpenAI en utilisant 10 fois plus de calcul, même si Zuckerberg admet que les agents d'IA sont en retard.

Google livre Nano Banana 2 Lite et Gemini Omni Flash pour une génération multimédia plus rapide et moins chère
Google a lancé Nano Banana 2 Lite, son modèle d'image le plus rapide à 0,034 $ pour 1 000 images, aux côtés de Gemini Omni Flash pour la génération vidéo et l'édition conversationnelle le 30 juin 2026.

Anthropic lance Claude Sonnet 5, son modèle intermédiaire le plus agentique à ce jour
Anthropic a publié Claude Sonnet 5 le 30 juin 2026, un modèle de milieu de gamme avec des performances agentiques rivalisant avec l'Opus 4.8 à un coût bien inférieur, avec un prix d'introduction de 2 $ par million de jetons d'entrée.

Meituan Open-Sources LongCat-2.0, un modèle de codage de 1,6 billion de paramètres entièrement formé sur des puces chinoises
Le chinois Meituan a publié LongCat-2.0, un modèle de codage mixte d'experts de 1,6 billion de paramètres formé sur 50 000 puces nationales sans matériel Nvidia.
Le mode rapide de Claude Opus 4.8 arrive dans GitHub Copilot alors qu'Anthropic approfondit le codage
GitHub Copilot propose désormais le mode rapide Claude Opus 4.8 en avant-première, offrant aux développeurs une augmentation de vitesse 2,5 fois supérieure à une fraction des coûts du mode rapide précédent.

L'Europe choisit Domyn de Milan pour construire un modèle d'IA ouvert de 400 milliards de paramètres
L'UE a sélectionné le consortium EUROPA dirigé par la startup italienne Domyn pour construire un modèle d'IA frontalier ouvert d'environ 400 milliards de paramètres couvrant les 24 langues officielles de l'UE.
OpenAI lance GPT-5.6 Sol, Terra et Luna en avant-première limitée avec de nouveaux garde-corps de sécurité
OpenAI a dévoilé la famille GPT-5.6 dirigée par le produit phare Sol, avec les niveaux Terra et Luna, un nouveau raisonnement multi-agents et sa pile de sécurité la plus robuste à ce jour dans un aperçu échelonné.

Sakana AI lance Fugu, un système multi-agent qui rivalise avec les modèles Frontier en orchestrant ses rivaux
La startup tokyoïte Sakana AI a dévoilé Fugu, un orchestrateur à API unique qui achemine dynamiquement les tâches à travers un pool échangeable de LLM frontières pour correspondre à Fable 5 d'Anthropic.
Google ajoute l'utilisation d'un ordinateur intégré à Gemini 3.5 Flash pour les agents IA multiplateformes
Google DeepMind a fait en sorte que l'ordinateur utilise un outil intégré dans Gemini 3.5 Flash, avec une formation contradictoire et des protections d'entreprise pour réduire le risque d'injection rapide.
Microsoft dévoile sept modèles MAI internes sans distillation pour réduire les coûts et réduire la dépendance à OpenAI
Microsoft a lancé sept modèles MAI lors de la Build 2026, dont un modèle de raisonnement qui correspond à l'Opus 4.6 d'Anthropic sur le codage, tous formés à partir de zéro sans distillation.
OpenAI prépare GPT-5.6 avec une fenêtre contextuelle de 1,5 million de jetons et une variante Pro
OpenAI devrait lancer GPT-5.6 dès la semaine prochaine, avec une fenêtre contextuelle de 1,5 million de jetons, un codage à long horizon amélioré et des variantes Mini et Pro ciblant Anthropic.

Les modèles d'IA chinois dépassent leurs rivaux américains en termes d'utilisation mondiale des jetons alors que DeepSeek V4 prend la première place
Les données d'OpenRouter montrent que des modèles chinois comme DeepSeek V4 Flash et MiniMax M3 dominent désormais la consommation mondiale de jetons, laissant ChatGPT et Gemini en dehors du top 10.

Zhipu lance GLM 5.2 alors que le PDG s'entretient avec Elon Musk sur la chronologie de l'IA frontalière en Chine
Le laboratoire chinois d'IA Zhipu a publié GLM 5.2 alors que le PDG Tang Jie a repoussé le calendrier d'Elon Musk du premier trimestre 2027 pour que la Chine atteigne l'IA de classe Fable.
