Η Microsoft παρουσίασε την Παρασκευή το Microsoft-Decision-1, ένα εξειδικευμένο μοντέλο για γρήγορη, δομημένη λήψη αποφάσεων, στην πλατφόρμα Foundry — και το κατασκεύασε στο ανοιχτού βάρους Qwen3.5-9B της Alibaba και όχι σε οποιοδήποτε μοντέλο από τον στενό συνεργάτη της OpenAI, ανέφερε το The New Stack.

Το λανσάρισμα γίνεται τρεις ημέρες αφότου το OpenAI άνοιξε το Decisions API του σε κάθε προγραμματιστή σε δημόσια beta και την ίδια μέρα η TypeSafe, η startup που πυροδότησε την κατηγορία του μοντέλου απόφασης με τον Jev πριν από περίπου τρεισήμισι εβδομάδες, ανακοίνωσε μια Series A 870 εκατομμυρίων δολαρίων με αποτίμηση 7,5 δισεκατομμυρίων δολαρίων με επικεφαλής τον a16z. Η Microsoft τιμολόγησε το Decision-1 ακριβώς με την τιμή Jev: 0,042 $ ανά εκατομμύριο διακριτικά εισόδου με δωρεάν έξοδο. Για περισσότερα σχετικά με τον αγώνα επιτάχυνσης για να γίνει η τεχνητή νοημοσύνη φθηνότερη και ταχύτερη, ανατρέξτε στη συνεχιζόμενη κάλυψη βιομηχανίας AI.

Τιμές για αντιστοίχιση Jev, χτισμένο στα ανοιχτά βάρη ενός αντιπάλου

Το Decision-1 είναι ένα μετεκπαιδευμένο μοντέλο: Η Microsoft ξεκίνησε από το Qwen3.5-9B της Alibaba και το συντόνισε για εργασίες δομημένης απόφασης και όχι για ανοιχτή παραγωγή. Η εταιρεία λέει ότι σχεδιάζει να επανατοποθετήσει το μοντέλο στα δικά της μοντέλα MAI καθώς και στα μοντέλα OpenAI, αλλά η αρχική επιλογή μιας κινεζικής βάσης ανοιχτού βάρους είναι αξιοσημείωτη για μια εταιρεία που επενδύει δισεκατομμύρια στο OpenAI.

Η Microsoft απέχει επίσης πολύ από την πρώτη κίνηση. Στις τρεισήμισι εβδομάδες από την κυκλοφορία του Jev, τα OpenAI, Upstage, Perplexity, Cloudflare και AWS έχουν αποστείλει όλα τα δικά τους μοντέλα απόφασης, σύμφωνα με το The New Stack. Η βάση Qwen3.5 που επέλεξε η Microsoft έχει γίνει κάτι σαν προεπιλογή του κλάδου: ο αντιπρόεδρος μηχανικής της Cognition, Jared Palmer, ξόδεψε περίπου 95 $ στον υπολογισμό Modal H100 μεταφέροντας τα μοντέλα Kev ανοιχτού κώδικα στο Qwen3.5 και η Cloudflare δημιούργησε το μοντέλο Clef-flash στην ίδια βάση Qwen3.5-9B.

Η τιμή συγκλίνει επίσης. Ο Palmer αναφέρει το Kev-4B στο OpenRouter με 0,042 $ ανά εκατομμύριο διακριτικά εισόδου, το Perplexity χρεώνει 0,02 $ και το OpenAI χρεώνει πάνω από το διπλάσιο της τιμής του Jev. Σε αυτές τις τιμές, τα έσοδα από μεμονωμένες κλήσεις λήψης αποφάσεων είναι ελάχιστα — γεγονός που υποδηλώνει ότι η μεγαλύτερη ευκαιρία της Microsoft είναι να διατηρήσει την επισκεψιμότητα των αντιπροσώπων, συμπεριλαμβανομένων των γενετικών κλήσεων γύρω από κάθε απόφαση, μέσω του Foundry.

Η Microsoft είναι ο πρώτος της πελάτης

Ο πρόεδρος και διευθύνων σύμβουλος της Microsoft Satya Nadella ανακοίνωσε το μοντέλο στο X την Παρασκευή, γράφοντας ότι το Decision-1 "παρέχει κορυφαία απόδοση σε εργασίες δομημένης απόφασης, ξεπερνώντας τόσο τα LLM όσο και άλλα μοντέλα αποφάσεων σε καθυστέρηση και ποιότητα" και προσθέτοντας: "Το δοκιμάζουμε ήδη σε όλη τη Microsoft".

Τέσσερις εσωτερικές ομάδες το υποστήριξαν, ανά The New Stack. Το Xbox Research χρησιμοποίησε το Decision-1 για να ταξινομήσει περισσότερα από 10.000 κομμάτια σχολίων από τους παίκτες. Η ομάδα Copilot βαθμολόγησε τη συνομιλία και τις απαντήσεις των πρακτόρων με αυτήν. Οι μηχανικοί εφημερίας το χρησιμοποίησαν για να τραβήξουν το πλαίσιο κατά τη διάρκεια ζωντανών περιστατικών και το Microsoft Discovery το χρησιμοποίησε για να σκοράρει πειράματα προτού επανασχεδιάσει ένας πράκτορας.

Οι εσωτερικοί αριθμοί της Microsoft, όπως αναφέρθηκαν, ισχυρίζονται ότι το μοντέλο είναι περισσότερο από 14 φορές πιο γρήγορο από το GPT-6 Sol με ένα κλάσμα του κόστους για τον φόρτο εργασίας του Xbox και 46 φορές πιο συνεπές στο Discovery. Ο Achint Srivastava, αντιπρόεδρος μηχανικής λογισμικού στο Γραφείο CTO της Microsoft, εισήγαγε το Decision-1 ως έναν τρόπο προσθήκης λήψης αποφάσεων σε υπάρχουσες εφαρμογές, πράκτορες και ροές εργασίας "σε ένα ασφαλές, αξιόπιστο περιβάλλον".

Τι δεν μπορεί να κάνει η απόφαση-1

Η κυκλοφορία δείχνει επίσης πού η Microsoft ακολουθεί τους ανταγωνιστές. Η λίστα Foundry του Decision-1 λέει ότι δέχεται έως και 32.768 διακριτικά κειμένου και επιστρέφει JSON, αλλά δεν υποστηρίζει εικόνες — σε αντίθεση με το Decisions API του OpenAI και το Clef του Cloudflare, το οποίο χρησιμοποιεί κωδικοποιητή όρασης. Και ενώ το Cloudflare κυκλοφόρησε το Clef με την άδεια Apache 2.0, η Microsoft δεν έχει ανακοινώσει ανοιχτά βάρη για την Απόφαση-1.

Υπάρχει επίσης ένα ερώτημα συμβατότητας. Οι AWS, Upstage και Ollama υιοθέτησαν το System One API του TypeSafe, τώρα μια κοινή διεπαφή σε όλη την κατηγορία, αλλά η Microsoft δεν έχει πει εάν το Decision-1 είναι πλήρως συμβατό — αν και το δείγμα του κώδικα Foundry καλεί ένα τελικό σημείο /systemone.

Οι ισχυρισμοί βαθμονόμησης αξίζουν επίσης έλεγχο. Η Microsoft λέει ότι οι πιθανότητες του Decision-1 είναι βαθμονομημένες, που σημαίνει ότι μια πρόβλεψη 90% θα πρέπει να είναι σωστή περίπου εννέα φορές στις δέκα σε αντιπροσωπευτικές περιπτώσεις και η τεκμηρίωση της ίδιας της εταιρείας συμβουλεύει τους πελάτες να επικυρώσουν τη βαθμονόμηση στα δεδομένα τους. Αυτή η προσοχή απηχεί την προεκτύπωση του JevOut, στην οποία ο ερευνητής της επιστήμης υπολογιστών του USC Zixiang Xu και οι συγγραφείς του βρήκαν ότι οι σύντομες, φυσικές προσθήκες στο πλαίσιο ανατρέπουν 312 από τις 508 αρχικά σωστές αποφάσεις του Jev - και σε 229 περιπτώσεις ο Jev εκχωρεί τουλάχιστον 70% πιθανότητα σε λάθος απάντηση. Τρία άλλα συστήματα βαθμολόγησης έδειξαν ποσοστά αναστροφής μεταξύ 64,9% και 73,2% με την ίδια προσέγγιση δοκιμών. Η Microsoft λέει ότι δοκίμασε το Decision-1 με οκτώ είδη διαταραχών, συμπεριλαμβανομένων των αναδιάταξης επιλογών και των παραφρασμένων περιγραφών.

Αποφάσεις δρομολόγησης σε Copilot, GitHub και Xbox

Το μοντέλο μπορεί να έχει μεγαλύτερη δουλειά μπροστά. Την Τετάρτη, η Microsoft είπε ότι το GitHub Copilot θα αποφασίσει σύντομα πότε θα εκτελέσει μια εργασία στη συσκευή και πότε θα την στείλει σε μοντέλα κλίμακας cloud, αν και δεν έχει αποκαλύψει τι στέλνει το Copilot στο cloud. Η δρομολόγηση μοντέλου είναι μεταξύ των περιπτώσεων χρήσης που παραθέτει η Microsoft για το Decision-1, αλλά η εταιρεία δεν έχει επιβεβαιώσει ότι το μοντέλο θα πραγματοποιήσει αυτές τις κλήσεις. Με τις αποφάσεις δρομολόγησης που πρέπει να λαμβάνονται σε Copilot, GitHub και Xbox, η Microsoft έχει ένα κίνητρο να τις χειρίζεται εσωτερικά.

Τα ανταγωνιστικά στοιχήματα είναι ορατά στην πρόσφυση του TypeSafe. Ο Διευθύνων Σύμβουλος του TypeSafe, Ντιόγκο Αλμέιδα, δημοσίευσε στο X ότι "29,4% του Fortune 500 εμφανίστηκε" τις τρεις εβδομάδες από την κυκλοφορία του Jev, ότι το μοντέλο "σέρβιρε κατά λάθος τρισεκατομμύρια μάρκες την ημέρα" και, έχοντας υπόψη τον φόρτο εργασίας της ομάδας του, ότι "έχουν περάσει 3 εβδομάδες που θα θέλαμε να κοιμηθούμε τώρα". Αυτές είναι οι ίδιες επιχειρήσεις στις οποίες η Microsoft πουλά το Azure — γεγονός που καθιστά την άφιξη του Decision-1 λιγότερο ένα στοίχημα σε μια νέα αγορά παρά μια υπεράσπιση μιας υπάρχουσας.

---

Μείνετε μπροστά από την τεχνητή νοημοσύνη

Λάβετε τα πιο πρόσφατα νέα, αναλύσεις και ανακαλύψεις για την τεχνητή νοημοσύνη — όλα σε ένα μέρος.

Διαβάστε περισσότερα νέα AI →