Microsoft pada hari Jumat meluncurkan Microsoft-Decision-1, model khusus untuk pengambilan keputusan yang cepat dan terstruktur, pada platform Foundry-nya — dan membangunnya di Qwen3.5-9B open-weight Alibaba, bukan pada model apa pun dari mitra dekatnya OpenAI, The New Stack melaporkan.

Peluncuran ini dilakukan tiga hari setelah OpenAI membuka Decisions API untuk setiap pengembang dalam versi beta publik, dan pada hari yang sama TypeSafe, startup yang memulai kategori model keputusan bersama Jev sekitar tiga setengah minggu lalu, mengumumkan Seri A senilai $870 juta dengan valuasi $7,5 miliar yang dipimpin oleh a16z. Microsoft memberi harga pada Keputusan-1 persis dengan harga Jev: $0,042 per juta token masukan dengan keluaran gratis. Untuk informasi lebih lanjut mengenai percepatan perlombaan untuk menjadikan AI lebih murah dan lebih cepat, lihat cakupan industri AI.

Harga Sesuai dengan Jev, Dibuat dengan Bobot Terbuka Rival

Keputusan-1 adalah model pasca-pelatihan: Microsoft memulai dari Qwen3.5-9B milik Alibaba dan menyesuaikannya untuk tugas pengambilan keputusan terstruktur, bukan generasi terbuka. Perusahaan tersebut mengatakan pihaknya berencana untuk mengubah basis model tersebut pada model MAI miliknya dan juga OpenAI, namun pilihan awal basis bobot terbuka Tiongkok merupakan hal yang penting bagi perusahaan yang berinvestasi miliaran dolar pada OpenAI.

Microsoft juga jauh dari penggerak pertama. Dalam tiga setengah minggu sejak Jev diluncurkan, OpenAI, Upstage, Perplexity, Cloudflare, dan AWS semuanya telah mengirimkan model keputusan mereka sendiri, menurut The New Stack. Basis Qwen3.5 yang dipilih Microsoft telah menjadi standar industri: wakil presiden bidang teknik Cognition, Jared Palmer, menghabiskan sekitar $95 dalam komputasi Modal H100 untuk mem-porting model Kev sumber terbukanya ke Qwen3.5, dan Cloudflare membangun model Clef-flash-nya pada basis Qwen3.5-9B yang sama.

Harga juga konvergen. Palmer mencantumkan Kev-4B di OpenRouter dengan harga $0,042 per juta token masukan, Perplexity mengenakan biaya $0,02, dan OpenAI mengenakan biaya lebih dari dua kali lipat tarif Jev. Dengan harga tersebut, pendapatan dari panggilan pengambilan keputusan individu sangat minim — yang menunjukkan bahwa peluang Microsoft yang lebih besar adalah menjaga lalu lintas agen, termasuk panggilan generatif seputar setiap keputusan, berjalan melalui Foundry.

Microsoft Adalah Pelanggan Pertamanya Sendiri

Ketua dan CEO Microsoft Satya Nadella mengumumkan model pada X pada hari Jumat, menulis bahwa Keputusan-1 "memberikan kinerja terbaik pada tugas keputusan terstruktur, mengungguli LLM dan model keputusan lainnya dalam latensi dan kualitas," dan menambahkan, "Kami sudah mengujinya di seluruh Microsoft."

Empat tim internal mendukung hal itu, menurut The New Stack. Xbox Research menggunakan Keputusan-1 untuk menyortir lebih dari 10.000 masukan pemain. Tim Kopilot menilai respons obrolan dan agen dengannya. Insinyur panggilan menggunakannya untuk menarik konteks selama insiden langsung, dan Microsoft Discovery menggunakannya untuk menilai eksperimen sebelum agen melakukan perencanaan ulang.

Angka internal Microsoft, seperti dilaporkan, mengklaim model ini 14 kali lebih cepat dari GPT-6 Sol dengan biaya yang lebih murah untuk beban kerja Xbox, dan 46 kali lebih konsisten di Discovery. Achint Srivastava, wakil presiden rekayasa perangkat lunak di Kantor CTO Microsoft, memperkenalkan Keputusan-1 sebagai cara untuk menambahkan pengambilan keputusan ke aplikasi, agen, dan alur kerja yang ada "dalam lingkungan yang aman dan tepercaya."

Apa yang Tidak Dapat Dilakukan oleh Keputusan-1

Peluncuran ini juga menunjukkan di mana Microsoft tertinggal dari para pesaingnya. Daftar Foundry Decision-1 mengatakan ia menerima hingga 32.768 token teks dan mengembalikan JSON, tetapi tidak mendukung gambar — tidak seperti Decisions API OpenAI dan Clef Cloudflare, yang menggunakan encoder visi. Dan meskipun Cloudflare merilis Clef di bawah lisensi Apache 2.0 yang permisif, Microsoft belum mengumumkan bobot terbuka untuk Keputusan-1.

Ada juga pertanyaan kompatibilitas. AWS, Upstage, dan Ollama telah mengadopsi API System One TypeSafe, yang sekarang menjadi antarmuka umum di seluruh kategori, namun Microsoft belum mengatakan apakah Decision-1 sepenuhnya kompatibel — meskipun kode sampel Foundry-nya memanggil titik akhir /systemone.

Klaim kalibrasi juga patut mendapat perhatian. Microsoft mengatakan probabilitas Keputusan-1 telah dikalibrasi, yang berarti prediksi 90% seharusnya benar sekitar sembilan kali dalam sepuluh kasus yang representatif, dan dokumentasi perusahaan menyarankan pelanggan untuk memvalidasi kalibrasi pada data mereka. Kehati-hatian tersebut sejalan dengan pracetak JevOut, di mana peneliti ilmu komputer USC Zixiang Xu dan rekan penulisnya menemukan bahwa penambahan konteks yang singkat dan terdengar alami membalikkan 312 dari 508 keputusan Jev yang pada awalnya benar — dan dalam 229 kasus, Jev menetapkan setidaknya 70% kemungkinan untuk jawaban yang salah. Tiga sistem penilaian lainnya menunjukkan tingkat flip rate antara 64,9% dan 73,2% dengan pendekatan pengujian yang sama. Microsoft mengatakan pihaknya menguji Keputusan-1 dengan delapan jenis gangguan, termasuk opsi yang disusun ulang dan deskripsi yang diparafrasekan.

Merutekan Keputusan di Copilot, GitHub, dan Xbox

Model tersebut mungkin memiliki pekerjaan yang lebih besar di masa depan. Pada hari Rabu, Microsoft mengatakan GitHub Copilot akan segera memutuskan kapan menjalankan tugas di perangkat dan kapan mengirimkannya ke model skala cloud, meskipun belum mengungkapkan apa yang Copilot kirimkan ke cloud. Perutean model adalah salah satu kasus penggunaan yang dicantumkan Microsoft untuk Keputusan-1, namun perusahaan belum mengonfirmasi bahwa model tersebut akan melakukan panggilan tersebut. Dengan keputusan perutean yang harus diambil di Copilot, GitHub, dan Xbox, Microsoft memiliki insentif untuk menanganinya secara internal.

Taruhan kompetitif terlihat dalam daya tarik TypeSafe. CEO TypeSafe Diogo Almeida memposting di X bahwa "29,4% dari Fortune 500 muncul" dalam tiga minggu sejak Jev diluncurkan, bahwa model tersebut "secara tidak sengaja menyajikan triliunan token setiap hari," dan, dengan memperhatikan beban kerja timnya, bahwa "sudah 3 minggu kami ingin tidur sekarang." Ini adalah perusahaan yang sama dengan tempat Microsoft menjual Azure — yang menjadikan kedatangan Decision-1 bukan merupakan pertaruhan pada pasar baru, melainkan pertahanan terhadap pasar yang sudah ada.

---

Tetap Terdepan dalam AI

Dapatkan berita, analisis, dan terobosan AI terkini — semuanya di satu tempat.

Baca berita AI selengkapnya →