Microsoft pada hari Jumaat melancarkan Microsoft-Decision-1, model khusus untuk membuat keputusan yang pantas dan berstruktur, pada platform Foundrynya — dan membinanya di atas Qwen3.5-9B berwajaran terbuka Alibaba dan bukannya pada mana-mana model daripada rakan kongsi rapatnya OpenAI, lapor The New Stack.
Pelancaran mendarat tiga hari selepas OpenAI membuka API Keputusannya kepada setiap pembangun dalam beta awam, dan pada hari yang sama TypeSafe, syarikat permulaan yang menyalakan kategori model keputusan dengan Jev kira-kira tiga setengah minggu lalu, mengumumkan Siri A $870 juta pada penilaian $7.5 bilion yang diketuai oleh a16z. Microsoft menetapkan harga Decision-1 pada kadar yang tepat Jev: $0.042 setiap juta token input dengan output percuma. Untuk mendapatkan maklumat lanjut tentang perlumbaan yang semakin pantas untuk menjadikan AI lebih murah dan lebih pantas, lihat [liputan industri AI] kami yang berterusan (https://aibuzzwire.news).
Harga Sepadan dengan Jev, Dibina di atas Wajaran Terbuka Saingan
Keputusan-1 ialah model lepas terlatih: Microsoft bermula dari Qwen3.5-9B Alibaba dan menyesuaikannya untuk tugas keputusan berstruktur dan bukannya penjanaan terbuka. Syarikat itu berkata ia merancang untuk mengasaskan semula model itu pada model MAInya sendiri serta OpenAI, tetapi pilihan awal asas berwajaran terbuka Cina adalah terkenal bagi syarikat yang melabur berbilion-bilion dalam OpenAI.
Microsoft juga jauh dari penggerak pertama. Dalam tiga setengah minggu sejak Jev dilancarkan, OpenAI, Upstage, Perplexity, Cloudflare, dan AWS semuanya telah menghantar model keputusan mereka sendiri, menurut The New Stack. Pangkalan Qwen3.5 yang dipilih Microsoft telah menjadi sesuatu yang lalai dalam industri: Naib presiden kejuruteraan Cognition, Jared Palmer, membelanjakan kira-kira $95 dalam pengiraan Modal H100 mengalihkan model Kev sumber terbukanya ke Qwen3.5, dan Cloudflare membina model Clef-flashnya pada pangkalan Qwen3.5-9B yang sama.
Harga juga bertumpu. Palmer menyenaraikan Kev-4B pada OpenRouter pada $0.042 setiap juta token input, Perplexity mengenakan bayaran $0.02, dan OpenAI mengenakan lebih daripada dua kali ganda kadar Jev. Pada harga tersebut, hasil daripada panggilan keputusan individu adalah minimum — yang menunjukkan peluang Microsoft yang lebih besar ialah mengekalkan trafik ejen, termasuk panggilan generatif di sekitar setiap keputusan, berjalan melalui Foundry.
Microsoft Adalah Pelanggan Pertamanya Sendiri
Pengerusi dan Ketua Pegawai Eksekutif Microsoft Satya Nadella mengumumkan model itu pada X pada hari Jumaat, menulis bahawa Decision-1 "menyampaikan prestasi terbaik pada tugas keputusan berstruktur, mengatasi kedua-dua LLM dan model keputusan lain dalam kependaman dan kualiti," dan menambah, "Kami sudah mengujinya di seluruh Microsoft."
Empat pasukan dalaman menyokongnya, setiap The New Stack. Xbox Research menggunakan Decision-1 untuk mengisih lebih daripada 10,000 keping maklum balas pemain. Pasukan Copilot menilai sembang dan respons ejen dengannya. Jurutera dalam panggilan menggunakannya untuk menarik konteks semasa kejadian langsung, dan Microsoft Discovery menggunakannya untuk menjaringkan percubaan sebelum ejen merancang semula.
Nombor dalaman Microsoft, seperti yang dilaporkan, mendakwa model itu lebih daripada 14 kali lebih pantas daripada GPT-6 Sol pada sebahagian kecil daripada kos untuk beban kerja Xbox, dan 46 kali lebih konsisten dalam Discovery. Achint Srivastava, naib presiden kejuruteraan perisian di Pejabat CTO Microsoft, memperkenalkan Keputusan-1 sebagai satu cara untuk menambah pembuatan keputusan pada aplikasi, ejen dan aliran kerja sedia ada "dalam persekitaran yang selamat dan dipercayai."
Apa Keputusan-1 Tidak Boleh Lakukan
Pelancaran itu juga menunjukkan di mana Microsoft mengekori saingan. Penyenaraian Foundry Decision-1 mengatakan ia menerima sehingga 32,768 token teks dan mengembalikan JSON, tetapi ia tidak menyokong imej — tidak seperti OpenAI's Decisions API dan Cloudflare's Clef, yang menggunakan pengekod penglihatan. Dan sementara Cloudflare mengeluarkan Clef di bawah lesen Apache 2.0 yang permisif, Microsoft tidak mengumumkan wajaran terbuka untuk Keputusan-1.
Terdapat juga soalan keserasian. AWS, Upstage dan Ollama telah menggunakan API System One TypeSafe, kini antara muka biasa merentas kategori, tetapi Microsoft tidak menyatakan sama ada Decision-1 serasi sepenuhnya — walaupun kod sampel Foundrynya memanggil titik akhir /systemone.
Tuntutan penentukuran patut diteliti juga. Microsoft mengatakan kebarangkalian Keputusan-1 ditentukur, bermakna ramalan 90% sepatutnya tepat kira-kira sembilan kali dalam sepuluh pada kes yang mewakili, dan dokumentasi syarikat sendiri menasihatkan pelanggan untuk mengesahkan penentukuran pada data mereka. Kehati-hatian itu mengulangi pracetak JevOut, di mana penyelidik sains komputer USC Zixiang Xu dan pengarang bersama mendapati bahawa penambahan pendek dan bunyi semula jadi pada konteks membalikkan 312 daripada 508 keputusan Jev yang pada mulanya betul — dan dalam 229 kes Jev memberikan sekurang-kurangnya 70% kebarangkalian kepada jawapan yang salah. Tiga sistem pemarkahan lain menunjukkan kadar flip antara 64.9% dan 73.2% di bawah pendekatan ujian yang sama. Microsoft berkata ia menguji Keputusan-1 dengan lapan jenis gangguan, termasuk pilihan yang disusun semula dan penerangan yang diparafrasa.
Keputusan Penghalaan Merentasi Copilot, GitHub dan Xbox
Model itu mungkin mempunyai tugas yang lebih besar di hadapan. Pada hari Rabu, Microsoft berkata GitHub Copilot tidak lama lagi akan memutuskan bila untuk menjalankan tugas pada peranti dan bila untuk menghantarnya ke model skala awan, walaupun ia tidak mendedahkan perkara yang dihantar oleh Copilot kepada awan. Penghalaan model adalah antara kes penggunaan yang disenaraikan oleh Microsoft untuk Keputusan-1, tetapi syarikat itu belum mengesahkan bahawa model itu akan membuat panggilan tersebut. Dengan keputusan penghalaan yang perlu dibuat merentas Copilot, GitHub dan Xbox, Microsoft mempunyai insentif untuk mengendalikannya secara dalaman.
Pertaruhan kompetitif boleh dilihat dalam daya tarikan TypeSafe. Ketua Pegawai Eksekutif TypeSafe Diogo Almeida menyiarkan pada X bahawa "29.4% daripada Fortune 500 muncul" dalam tempoh tiga minggu sejak Jev dilancarkan, bahawa model itu "secara tidak sengaja menyampaikan trilion token sehari," dan, dengan memerhatikan beban kerja pasukannya, bahawa "sudah 3 minggu kami ingin tidur sekarang." Itu adalah perusahaan yang sama yang Microsoft jual Azure kepada — yang menjadikan kedatangan Decision-1 kurang menjadi pertaruhan pada pasaran baharu berbanding mempertahankan pasaran sedia ada.
---
Kekal Mendahului AIDapatkan berita, analisis dan penemuan terkini AI — semuanya di satu tempat.
Baca lebih banyak berita AI →

