Microsoft a lancé vendredi Microsoft-Decision-1, un modèle spécialisé pour une prise de décision rapide et structurée, sur sa plate-forme Foundry – et l'a construit sur le Qwen3.5-9B à poids ouvert d'Alibaba plutôt que sur n'importe quel modèle de son partenaire proche OpenAI, a rapporté The New Stack.
Le lancement a lieu trois jours après qu'OpenAI a ouvert son API Decisions à tous les développeurs en version bêta publique, et le même jour, TypeSafe, la startup qui a lancé la catégorie des modèles de décision avec Jev il y a environ trois semaines et demie, a annoncé une série A de 870 millions de dollars pour une valorisation de 7,5 milliards de dollars dirigée par a16z. Microsoft a fixé le prix de Decision-1 exactement au tarif de Jev : 0,042 $ par million de jetons d'entrée avec sortie gratuite. Pour en savoir plus sur la course accélérée visant à rendre l'IA moins chère et plus rapide, consultez notre Couverture de l'industrie de l'IA.
Prix adapté à Jev, construit sur les poids ouverts d'un rival
Decision-1 est un modèle post-entraîné : Microsoft est parti du Qwen3.5-9B d'Alibaba et l'a adapté à des tâches de décision structurées plutôt qu'à une génération ouverte. La société affirme qu'elle envisage de rebaser le modèle sur ses propres modèles MAI ainsi que sur ceux d'OpenAI, mais le choix initial d'une base chinoise à pondération ouverte est remarquable pour une entreprise qui investit des milliards dans OpenAI.
Microsoft est également loin d’être le premier arrivé. Au cours des trois semaines et demie écoulées depuis le lancement de Jev, OpenAI, Upstage, Perplexity, Cloudflare et AWS ont tous livré leurs propres modèles de décision, selon The New Stack. La base Qwen3.5 choisie par Microsoft est devenue une sorte de défaut de l'industrie : le vice-président de l'ingénierie de Cognition, Jared Palmer, a dépensé environ 95 $ en calcul Modal H100 pour porter ses modèles Kev open source vers Qwen3.5, et Cloudflare a construit son modèle Clef-flash sur la même base Qwen3.5-9B.
Les prix convergent également. Palmer répertorie Kev-4B sur OpenRouter à 0,042 $ par million de jetons d'entrée, Perplexity facture 0,02 $ et OpenAI facture plus du double du tarif de Jev. À ces prix, les revenus provenant des appels de décision individuels sont minimes, ce qui suggère que la plus grande opportunité pour Microsoft est de maintenir le trafic des agents, y compris les appels génératifs autour de chaque décision, via Foundry.
Microsoft est son propre premier client
Le président-directeur général de Microsoft, Satya Nadella, a annoncé le modèle sur X vendredi, écrivant que Decision-1 "offre des performances optimales sur les tâches de décision structurées, surpassant à la fois les LLM et les autres modèles de décision en termes de latence et de qualité", et ajoutant : "Nous le testons déjà au sein de Microsoft".
Quatre équipes internes ont soutenu cela, selon The New Stack. Xbox Research a utilisé Decision-1 pour trier plus de 10 000 commentaires de joueurs. L’équipe Copilot a évalué les réponses des chats et des agents grâce à lui. Les ingénieurs de garde l'ont utilisé pour extraire le contexte lors d'incidents en direct, et Microsoft Discovery l'a utilisé pour évaluer les expériences avant qu'un agent ne replanifie.
Les chiffres internes de Microsoft, comme indiqué, affirment que le modèle est plus de 14 fois plus rapide que GPT-6 Sol pour une fraction du coût de la charge de travail Xbox et 46 fois plus cohérent dans Discovery. Achint Srivastava, vice-président de l'ingénierie logicielle au Bureau du CTO de Microsoft, a présenté Decision-1 comme un moyen d'ajouter la prise de décision aux applications, agents et flux de travail existants « dans un environnement sécurisé et fiable ».
Ce que la décision 1 ne peut pas faire
Le lancement montre également où Microsoft est à la traîne de ses concurrents. La liste Foundry de Decision-1 indique qu'elle accepte jusqu'à 32 768 jetons de texte et renvoie JSON, mais elle ne prend pas en charge les images, contrairement à l'API Decisions d'OpenAI et à Clef de Cloudflare, qui utilisent un encodeur de vision. Et bien que Cloudflare ait publié Clef sous la licence permissive Apache 2.0, Microsoft n'a pas annoncé de pondérations ouvertes pour Decision-1.
Il y a aussi une question de compatibilité. AWS, Upstage et Ollama ont adopté l'API System One de TypeSafe, désormais une interface commune dans toute la catégorie, mais Microsoft n'a pas précisé si Decision-1 était entièrement compatible – bien que son exemple de code Foundry appelle un point de terminaison /systemone.
Les allégations d’étalonnage méritent également un examen minutieux. Microsoft affirme que les probabilités de Decision-1 sont calibrées, ce qui signifie qu'une prédiction de 90 % devrait être exacte environ neuf fois sur dix dans des cas représentatifs, et la propre documentation de l'entreprise conseille aux clients de valider l'étalonnage sur leurs données. Cette mise en garde fait écho à la prépublication de JevOut, dans laquelle Zixiang Xu, chercheur en informatique à l'USC, et ses co-auteurs ont découvert que de courts ajouts au contexte, à consonance naturelle, renversaient 312 des 508 décisions initialement correctes de Jev - et dans 229 cas, Jev attribuait au moins 70 % de probabilité à la mauvaise réponse. Trois autres systèmes de notation ont montré des taux de retournement compris entre 64,9 % et 73,2 % selon la même approche de test. Microsoft affirme avoir testé Decision-1 avec huit types de perturbations, y compris des options réorganisées et des descriptions paraphrasées.
Décisions de routage entre Copilot, GitHub et Xbox
Le modèle pourrait avoir un travail plus important à accomplir. Mercredi, Microsoft a déclaré que GitHub Copilot déciderait bientôt quand exécuter une tâche sur l'appareil et quand l'envoyer aux modèles à l'échelle du cloud, bien qu'il n'ait pas révélé ce que Copilot envoie au cloud. Le routage du modèle fait partie des cas d'utilisation répertoriés par Microsoft pour la décision 1, mais la société n'a pas confirmé que le modèle effectuera ces appels. Avec les décisions de routage à prendre entre Copilot, GitHub et Xbox, Microsoft est incité à les gérer en interne.
Les enjeux concurrentiels sont visibles dans la traction de TypeSafe. Le PDG de TypeSafe, Diogo Almeida, a publié sur X que « 29,4 % des Fortune 500 sont apparus » au cours des trois semaines écoulées depuis le lancement de Jev, que le modèle « a accidentellement servi des milliards de jetons par jour » et, compte tenu de la charge de travail de son équipe, que « cela fait 3 semaines que nous aimerions dormir maintenant ». Ce sont les mêmes entreprises auxquelles Microsoft vend Azure – ce qui fait de l’arrivée de Decision-1 moins un pari sur un nouveau marché qu’une défense d’un marché existant.
---
Gardez une longueur d'avance sur l'IARecevez les dernières actualités, analyses et avancées en matière d'IA, le tout en un seul endroit.
Lire plus d'actualités sur l'IA →

