Microsoft a dévoilé une famille de sept modèles d'intelligence artificielle internes sous la bannière MAI, un lancement dévoilé lors de sa conférence des développeurs Build 2026 qui signale un effort concerté pour posséder davantage de pile d'IA et réduire sa dépendance à l'égard de son partenaire OpenAI. Les nouveaux modèles couvrent le raisonnement, le codage, la génération d'images, la transcription et la voix, et Microsoft affirme qu'ils ont été formés à partir de zéro avec ce qu'il appelle la « distillation zéro ».
L'expansion exerce une nouvelle pression sur OpenAI, Anthropic et Google tout en offrant aux développeurs un ensemble d'options plus large et potentiellement moins cher. Étant donné que Microsoft possède à la fois les modèles et le calcul cloud Azure qui les exécute, cela peut réduire le coût par jeton que les développeurs paient pour créer avec eux. Pour plus de contexte sur cette histoire, consultez notre actualités IA.
Un modèle de raisonnement phare
La version phare est MAI-Thinking-1, décrite par Microsoft comme son premier modèle de raisonnement. Dans un article de blog accompagnant le lancement, la société a souligné l'efficacité du modèle et le faible coût des jetons, et était particulièrement impatiente de partager que MAI-Thinking-1 correspondait à l'Opus 4.6 d'Anthropic en termes de tests de codage. Cette affirmation positionne le moteur de raisonnement local de Microsoft comme compétitif par rapport aux modèles pionniers de ses plus proches rivaux en matière d'IA.
Les modèles de raisonnement, qui nécessitent des calculs supplémentaires pour « réfléchir » aux problèmes avant d’y répondre, sont devenus un champ de bataille déterminant en 2026 alors que les laboratoires se précipitent pour construire des systèmes capables d’ingénierie logicielle, de mathématiques et d’analyse scientifique en plusieurs étapes.
Distillation zéro : entraînée, non copiée
Un différenciateur central sur lequel Microsoft s'appuie est le concept de « distillation zéro ». La distillation est la technique largement utilisée pour entraîner un modèle plus petit afin d’imiter un modèle préexistant plus grand. C'est moins cher et plus rapide qu'une formation à partir de zéro, mais cela limite la qualité du modèle résultant, car l'élève ne peut qu'imiter le comportement de son enseignant.
Microsoft souligne que ses nouveaux modèles MAI sont « formés à partir de zéro sans distillation », ce qui signifie qu'il s'agit d'architectures originales plutôt que d'imitations d'un autre système. Le chef de l'IA de Microsoft, Mustafa Suleyman, a défini la stratégie comme une construction ascendante à partir d'une fondation commune.
"Tous ces modèles sont construits sur une base commune, gravissant les collines depuis le bas sans distillation", a déclaré Suleyman. "Ils partagent la même discipline en matière de données, la même infrastructure et le même cadre d'évaluation. Ils sont conçus pour fonctionner ensemble et s'intégrer directement dans les produits que les gens utilisent quotidiennement. Mais les modèles eux-mêmes ne sont qu'une partie de l'histoire."
La gamme complète du MAI
Les sept modèles annoncés par Microsoft couvrent plusieurs modalités :
- MAI-Thinking-1 - le modèle de raisonnement phare.
- MAI-Code-1-Flash - un modèle de codage rapide et léger.
- MAI-Image-2.5 - Le premier modèle de Microsoft capable de générer du texte à l'image et de l'image à l'image.
- MAI-Image-2.5-Flash - une variante plus rapide destinée aux charges de travail sensibles aux coûts.
- MAI-Transcribe-1.5 - un modèle de transcription amélioré adapté aux charges de travail du monde réel.
- MAI-Voice-2 - un modèle de génération vocale.
- MAI-Voice-2-Flash - une variante vocale distillée-rapide.
Certaines entrées sont des variantes construites sur la même base sous-jacente, mais ensemble, elles offrent à Microsoft des fonctionnalités natives dans le raisonnement textuel, le code, la vision et l'audio, catégories dans lesquelles il s'appuyait auparavant fortement sur la famille GPT d'OpenAI.
Images Dirigez-vous vers PowerPoint et OneDrive
Les modèles MAI-Image-2.5 sont d'abord déployés au sein du propre écosystème de produits de Microsoft. Les modèles d'images complets et Flash sont désormais disponibles en avant-première pour les utilisateurs de PowerPoint et OneDrive for Foundry, ce qui donne à l'entreprise la possibilité de présenter ses outils d'imagerie générative dans des applications de productivité largement utilisées avant de les ouvrir aux développeurs tiers.
Microsoft a déjà utilisé ce manuel d'intégration de nouvelles fonctionnalités d'IA dans Office et Windows pour favoriser l'adoption à grande échelle, un avantage de distribution que les laboratoires modèles autonomes ne peuvent pas facilement égaler.
Disponibilité des tiers et portée des développeurs
Au-delà du propre cloud de Microsoft, la société a déclaré que les modèles MAI seraient également disponibles via des plateformes d'inférence indépendantes. Les modèles devraient arriver sur Fireworks AI, Baseten et Open Router à l’avenir, élargissant ainsi l’accès aux développeurs qui construisent en dehors de l’écosystème Azure.
Cette approche multiplateforme reflète la stratégie de distribution à pondération ouverte devenue courante dans l'industrie, où les modèles sont proposés à la fois via la propre API du créateur et via des fournisseurs d'hébergement neutres.
Ce que cela signifie pour la relation OpenAI
Microsoft a investi des dizaines de milliards de dollars dans OpenAI et reste son partenaire d'infrastructure le plus proche, Azure alimentant une grande partie du calcul du fabricant de ChatGPT. Mais le lancement de MAI montre clairement que Microsoft ne veut plus être uniquement un revendeur de l'intelligence d'autrui.
En créant des modèles originaux à partir de zéro qu’il contrôle entièrement, Microsoft obtient un effet de levier de plusieurs manières. Il peut négocier en position d'indépendance, se protéger contre les décisions de prix ou de feuille de route d'un fournisseur unique et offrir aux développeurs une alternative optimisée en termes de coûts. Les analystes ont noté que l'investissement plus important de Microsoft dans l'IA va probablement remodeler les aspects économiques de la création d'applications d'IA, obligeant les concurrents à réagir à la fois en termes de qualité et de prix.
Un marché compétitif de l’IA se resserre encore
La famille MAI arrive dans un champ bondé. OpenAI continue de faire progresser sa gamme GPT, Anthropic a publié ses modèles de classe Mythos, Google fait progresser Gemini et les efforts de pondération ouverte des laboratoires du monde entier réduisent l'écart avec les systèmes propriétaires. La décision de Microsoft de déployer ses propres modèles dans autant de modalités à la fois suggère qu'elle a l'intention de rivaliser directement sur tous les fronts plutôt que de céder des catégories à des partenaires.
Pour les développeurs, le résultat pratique est un plus grand choix et, selon Microsoft, une réduction des coûts. Il reste à voir si la parité de codage de MAI-Thinking-1 avec Opus 4.6 résiste à des tests indépendants plus larges, mais la déclaration à elle seule marque un changement significatif : une entreprise qui a bâti sa réputation en matière d'IA sur la distribution des modèles d'OpenAI déclare maintenant qu'elle peut atteindre la frontière par elle-même.
Avec Build 2026 comme étape, Microsoft a clairement indiqué que la prochaine phase de sa stratégie d’IA est définie moins par le partenariat que par la propriété.
---
Restez à la Pointe de l'IALes dernières actualités, analyses et percées en IA — au même endroit.
Lire plus d'actualités IA →


