Microsoft venerdì ha lanciato Microsoft-Decision-1, un modello specializzato per un processo decisionale rapido e strutturato, sulla sua piattaforma Foundry e lo ha costruito sul Qwen3.5-9B a peso aperto di Alibaba anziché su qualsiasi modello del suo partner stretto OpenAI, ha riferito The New Stack.

Il lancio avviene tre giorni dopo che OpenAI ha aperto la sua API Decisions a tutti gli sviluppatori in beta pubblica, e lo stesso giorno TypeSafe, la startup che ha acceso la categoria dei modelli decisionali con Jev circa tre settimane e mezzo fa, ha annunciato una Serie A da 870 milioni di dollari con una valutazione di 7,5 miliardi di dollari guidata da a16z. Microsoft ha valutato Decision-1 esattamente al prezzo di Jev: 0,042 dollari per milione di token di input con output gratuito. Per ulteriori informazioni sulla corsa sempre più rapida per rendere l'intelligenza artificiale più economica e veloce, consulta la nostra copertura del settore dell'intelligenza artificiale in corso.

Prezzo adeguato a Jev, costruito sui pesi aperti di un rivale

Decision-1 è un modello post-addestrato: Microsoft è partita dal Qwen3.5-9B di Alibaba e lo ha ottimizzato per compiti decisionali strutturati piuttosto che per una generazione a tempo indeterminato. La società afferma di voler ribasare il modello sui propri modelli MAI e su OpenAI, ma la scelta iniziale di una base cinese a peso aperto è degna di nota per un'azienda che investe miliardi in OpenAI.

Anche Microsoft è lontana dall’essere la prima a muoversi. Nelle tre settimane e mezzo trascorse dal lancio di Jev, OpenAI, Upstage, Perplexity, Cloudflare e AWS hanno tutti fornito modelli decisionali propri, secondo The New Stack. La base Qwen3.5 scelta da Microsoft è diventata una sorta di default del settore: il vicepresidente dell'ingegneria di Cognition, Jared Palmer, ha speso circa 95 dollari in elaborazione Modal H100 per portare i suoi modelli Kev open source su Qwen3.5, e Cloudflare ha costruito il suo modello Clef-flash sulla stessa base Qwen3.5-9B.

Anche i prezzi stanno convergendo. Palmer elenca Kev-4B su OpenRouter a 0,042 dollari per milione di token di input, Perplexity addebita 0,02 dollari e OpenAI addebita più del doppio della tariffa di Jev. A questi prezzi, le entrate derivanti dalle chiamate decisionali individuali sono minime, il che suggerisce che la maggiore opportunità di Microsoft è mantenere il traffico degli agenti, comprese le chiamate generative attorno a ciascuna decisione, in esecuzione attraverso Foundry.

Microsoft è il suo primo cliente

Il presidente e CEO di Microsoft Satya Nadella ha annunciato il modello su X venerdì, scrivendo che Decision-1 "offre le massime prestazioni su compiti decisionali strutturati, superando sia i LLM che altri modelli decisionali in termini di latenza e qualità" e aggiungendo: "Lo stiamo già testando su Microsoft."

Quattro team interni lo hanno supportato, secondo The New Stack. Xbox Research ha utilizzato Decision-1 per ordinare più di 10.000 feedback dei giocatori. Il team di Copilot ha valutato con esso le risposte della chat e degli agenti. Gli ingegneri di turno lo hanno utilizzato per ricavare contesto durante gli incidenti in tempo reale e Microsoft Discovery lo ha utilizzato per valutare gli esperimenti prima che un agente ripianifichi.

I numeri interni di Microsoft, come riportato, affermano che il modello è più di 14 volte più veloce di GPT-6 Sol a una frazione del costo per il carico di lavoro Xbox e 46 volte più coerente in Discovery. Achint Srivastava, vicepresidente dell'ingegneria del software presso l'ufficio del CTO di Microsoft, ha introdotto Decision-1 come un modo per aggiungere il processo decisionale alle applicazioni, agli agenti e ai flussi di lavoro esistenti "in un ambiente sicuro e affidabile".

Cosa non può fare la Decisione-1

Il lancio mostra anche dove Microsoft segue i rivali. L'elenco Foundry di Decision-1 afferma che accetta fino a 32.768 token di testo e restituisce JSON, ma non supporta immagini, a differenza dell'API Decisions di OpenAI e di Clef di Cloudflare, che utilizza un codificatore di visione. E mentre Cloudflare ha rilasciato Clef sotto la permissiva licenza Apache 2.0, Microsoft non ha annunciato pesi aperti per Decision-1.

C'è anche una questione di compatibilità. AWS, Upstage e Ollama hanno adottato l'API System One di TypeSafe, ora un'interfaccia comune in tutta la categoria, ma Microsoft non ha detto se Decision-1 sia completamente compatibile, sebbene il suo codice di esempio Foundry richiami un endpoint /systemone.

Anche le affermazioni sulla calibrazione meritano un esame accurato. Microsoft afferma che le probabilità della Decisione-1 sono calibrate, il che significa che una previsione del 90% dovrebbe essere corretta circa nove volte su dieci in casi rappresentativi, e la documentazione dell'azienda consiglia ai clienti di convalidare la calibrazione sui propri dati. Questa cautela riecheggia la prestampa di JevOut, in cui il ricercatore di informatica dell'USC Zixiang Xu e i coautori hanno scoperto che brevi aggiunte al contesto dal suono naturale hanno ribaltato 312 delle 508 decisioni inizialmente corrette di Jev - e in 229 casi Jev ha assegnato almeno il 70% di probabilità alla risposta sbagliata. Altri tre sistemi di punteggio hanno mostrato tassi di ribaltamento compresi tra il 64,9% e il 73,2% con lo stesso approccio di test. Microsoft afferma di aver testato Decision-1 con otto tipi di perturbazioni, comprese opzioni riordinate e descrizioni parafrasate.

Decisioni di routing tra Copilot, GitHub e Xbox

Il modello potrebbe avere un lavoro più grande da svolgere. Mercoledì, Microsoft ha affermato che GitHub Copilot deciderà presto quando eseguire un'attività sul dispositivo e quando inviarla a modelli su scala cloud, sebbene non abbia rivelato cosa Copilot invia al cloud. Il routing del modello è tra i casi d'uso elencati da Microsoft per Decision-1, ma la società non ha confermato che il modello effettuerà tali chiamate. Con le decisioni di routing da prendere su Copilot, GitHub e Xbox, Microsoft ha un incentivo a gestirle internamente.

La posta in gioco competitiva è visibile nella trazione di TypeSafe. Il CEO di TypeSafe, Diogo Almeida, ha pubblicato su X che "il 29,4% delle aziende Fortune 500 si è presentato" nelle tre settimane successive al lancio di Jev, che il modello "ha accidentalmente servito trilioni di token al giorno" e, con un occhio al carico di lavoro del suo team, che "sono 3 settimane che vorremmo dormire adesso". Queste sono le stesse aziende a cui Microsoft vende Azure, il che rende l'arrivo di Decision-1 meno una scommessa su un nuovo mercato che una difesa di uno esistente.

---

Stai al passo con l'intelligenza artificiale

Ricevi le ultime notizie, analisi e scoperte sull'intelligenza artificiale, tutto in un unico posto.

Leggi altre notizie sull'AI →