เมื่อวันศุกร์ที่ผ่านมา Microsoft ได้เปิดตัว Microsoft-Decision-1 ซึ่งเป็นโมเดลเฉพาะสำหรับการตัดสินใจที่รวดเร็วและมีโครงสร้างบนแพลตฟอร์ม Foundry และสร้างขึ้นบน Qwen3.5-9B แบบเปิดของ Alibaba แทนที่จะเป็นโมเดลใดๆ จาก OpenAI ซึ่งเป็นพันธมิตรที่ใกล้ชิด The New Stack รายงาน
การเปิดตัวเกิดขึ้นสามวันหลังจาก OpenAI เปิด Decisions API ให้กับนักพัฒนาทุกคนในรุ่นเบต้าสาธารณะ และในวันเดียวกันนั้น TypeSafe สตาร์ทอัพที่จุดประกายหมวดหมู่รูปแบบการตัดสินใจร่วมกับ Jev ประมาณสามสัปดาห์ครึ่งที่แล้ว ได้ประกาศเปิดตัว Series A มูลค่า 870 ล้านดอลลาร์ ที่การประเมินมูลค่า 7.5 พันล้านดอลลาร์ นำโดย a16z Microsoft กำหนดราคา Decision-1 ในอัตราเดียวกับ Jev: 0.042 ดอลลาร์ต่อโทเค็นอินพุตหนึ่งล้านพร้อมเอาท์พุตฟรี หากต้องการข้อมูลเพิ่มเติมเกี่ยวกับการแข่งขันที่เร่งขึ้นเพื่อทำให้ AI ถูกลงและเร็วขึ้น โปรดดู ความครอบคลุมของอุตสาหกรรม AI ที่กำลังดำเนินอยู่
ราคาพอๆ กับ Jev สร้างขึ้นบน Open Weights ของคู่แข่ง
Decision-1 เป็นแบบจำลองหลังการฝึกอบรม: Microsoft เริ่มต้นจาก Qwen3.5-9B ของ Alibaba และปรับแต่งสำหรับงานการตัดสินใจที่มีโครงสร้างมากกว่ารุ่นปลายเปิด บริษัทกล่าวว่ามีแผนที่จะรีบูตโมเดลนี้บนโมเดล MAI ของตัวเองและของ OpenAI แต่ตัวเลือกเริ่มต้นของฐาน open-weight ของจีนนั้นมีความโดดเด่นสำหรับบริษัทที่ลงทุนหลายพันล้านใน OpenAI
Microsoft ยังห่างไกลจากผู้เสนอญัตติรายแรก ในช่วงสามสัปดาห์ครึ่งนับตั้งแต่เปิดตัว Jev OpenAI, Upstage, Perplexity, Cloudflare และ AWS ได้จัดส่งโมเดลการตัดสินใจของตนเองทั้งหมดตาม The New Stack ฐาน Qwen3.5 ที่ Microsoft เลือกได้กลายเป็นค่าเริ่มต้นของอุตสาหกรรม: Jared Palmer รองประธานฝ่ายวิศวกรรมของ Cognition ใช้เงินประมาณ 95 เหรียญสหรัฐในการคำนวณ Modal H100 ในการย้ายโมเดล Kev โอเพ่นซอร์สของเขาไปยัง Qwen3.5 และ Cloudflare ได้สร้างโมเดล Clef-flash บนฐาน Qwen3.5-9B เดียวกัน
ราคาก็มาบรรจบกันเช่นกัน Palmer แสดงรายการ Kev-4B บน OpenRouter ที่ 0.042 ดอลลาร์ต่อโทเค็นอินพุตหนึ่งล้านรายการ Perplexity เรียกเก็บเงิน 0.02 ดอลลาร์ และ OpenAI เรียกเก็บเงินมากกว่าอัตราของ Jev สองเท่า ในราคาดังกล่าว รายได้จากการตัดสินใจแต่ละครั้งมีน้อยมาก ซึ่งบ่งชี้ว่าโอกาสที่ยิ่งใหญ่กว่าของ Microsoft คือการรักษาปริมาณการรับส่งข้อมูลของตัวแทน รวมถึงการเรียกแบบกำเนิดรอบการตัดสินใจแต่ละครั้งที่ดำเนินการผ่าน Foundry
Microsoft เป็นลูกค้ารายแรกของตัวเอง
Satya Nadella ประธานและซีอีโอของ Microsoft ได้ประกาศโมเดลบน X เมื่อวันศุกร์ โดยเขียนว่า Decision-1 "มอบประสิทธิภาพสูงสุดในงานการตัดสินใจที่มีโครงสร้าง ซึ่งเหนือกว่าทั้ง LLM และโมเดลการตัดสินใจอื่นๆ ในด้านเวลาแฝงและคุณภาพ" และเสริมว่า "เรากำลังทดสอบทั่วทั้ง Microsoft แล้ว"
ทีมภายในสี่ทีมสำรองข้อมูลดังกล่าวตาม The New Stack Xbox Research ใช้ Decision-1 เพื่อจัดเรียงความคิดเห็นของผู้เล่นมากกว่า 10,000 ชิ้น ทีม Copilot ให้คะแนนการแชทและการตอบกลับของเจ้าหน้าที่ วิศวกรที่พร้อมโทรติดต่อใช้เพื่อดึงบริบทระหว่างเหตุการณ์สด และ Microsoft Discovery ใช้เพื่อให้คะแนนการทดลองก่อนที่ตัวแทนจะวางแผนใหม่
ตามที่รายงานตัวเลขภายในของ Microsoft อ้างว่าโมเดลนี้เร็วกว่า GPT-6 Sol มากกว่า 14 เท่าโดยมีค่าใช้จ่ายเพียงเล็กน้อยสำหรับเวิร์กโหลด Xbox และมีความสอดคล้องมากกว่า 46 เท่าใน Discovery Achint Srivastava รองประธานฝ่ายวิศวกรรมซอฟต์แวร์ใน Office of the CTO ของ Microsoft ได้แนะนำ Decision-1 เพื่อเพิ่มการตัดสินใจให้กับแอปพลิเคชัน เอเจนต์ และเวิร์กโฟลว์ที่มีอยู่ "ในสภาพแวดล้อมที่ปลอดภัยและเชื่อถือได้"
สิ่งที่การตัดสินใจ-1 ทำไม่ได้
การเปิดตัวยังแสดงให้เห็นว่า Microsoft ติดตามคู่แข่งรายใด รายการ Foundry ของ Decision-1 ระบุว่ายอมรับโทเค็นข้อความได้มากถึง 32,768 โทเค็นและส่งกลับ JSON แต่ไม่รองรับรูปภาพ ต่างจาก Decisions API ของ OpenAI และ Clef ของ Cloudflare ซึ่งใช้ตัวเข้ารหัสการมองเห็น และในขณะที่ Cloudflare เปิดตัว Clef ภายใต้ใบอนุญาต Apache 2.0 ที่ได้รับอนุญาต Microsoft ยังไม่ได้ประกาศน้ำหนักแบบเปิดสำหรับ Decision-1
นอกจากนี้ยังมีคำถามเกี่ยวกับความเข้ากันได้ AWS, Upstage และ Ollama ได้นำ System One API ของ TypeSafe มาใช้ ซึ่งปัจจุบันเป็นอินเทอร์เฟซทั่วไปสำหรับหมวดหมู่ต่างๆ แต่ Microsoft ไม่ได้บอกว่า Decision-1 เข้ากันได้อย่างสมบูรณ์หรือไม่ แม้ว่าโค้ดตัวอย่าง Foundry จะเรียกจุดสิ้นสุด /systemone ก็ตาม
การกล่าวอ้างการสอบเทียบสมควรได้รับการตรวจสอบเช่นกัน Microsoft กล่าวว่าความน่าจะเป็นของ Decision-1 ได้รับการปรับเทียบแล้ว ซึ่งหมายความว่าการคาดการณ์ 90% ควรถูกต้องประมาณเก้าครั้งในสิบในกรณีตัวอย่าง และเอกสารของบริษัทแนะนำให้ลูกค้าตรวจสอบความถูกต้องของการปรับเทียบข้อมูลของพวกเขา คำเตือนดังกล่าวสะท้อนถึงการพิมพ์ล่วงหน้าของ JevOut ซึ่ง Zixiang Xu นักวิจัยวิทยาการคอมพิวเตอร์ของ USC และผู้เขียนร่วมพบว่าการเพิ่มเติมเนื้อหาสั้นๆ ที่ฟังดูเป็นธรรมชาติทำให้การตัดสินใจที่ถูกต้องในตอนแรกของ Jev พลิกกลับ 312 ครั้งจากทั้งหมด 508 ครั้ง และใน 229 กรณี Jev กำหนดให้มีความน่าจะเป็นอย่างน้อย 70% ในคำตอบที่ผิด ระบบการให้คะแนนอีกสามระบบแสดงอัตราการพลิกระหว่าง 64.9% ถึง 73.2% ภายใต้วิธีการทดสอบเดียวกัน ไมโครซอฟต์กล่าวว่าได้ทดสอบ Decision-1 ด้วยการก่อกวนแปดรูปแบบ รวมถึงตัวเลือกที่เรียงลำดับใหม่และคำอธิบายที่ถอดความ
การตัดสินใจกำหนดเส้นทางข้าม Copilot, GitHub และ Xbox
โมเดลอาจมีงานที่ใหญ่กว่ารออยู่ข้างหน้า เมื่อวันพุธที่ผ่านมา Microsoft กล่าวว่า GitHub Copilot จะตัดสินใจว่าจะรันงานบนอุปกรณ์เมื่อใด และจะส่งไปยังโมเดลระดับคลาวด์เมื่อใด แม้ว่าจะไม่ได้เปิดเผยว่า Copilot ส่งอะไรไปยังคลาวด์ก็ตาม การกำหนดเส้นทางโมเดลเป็นหนึ่งในกรณีการใช้งานที่ Microsoft แสดงรายการสำหรับ Decision-1 แต่บริษัทยังไม่ยืนยันว่าโมเดลจะทำการเรียกเหล่านั้น ด้วยการตัดสินใจกำหนดเส้นทางใน Copilot, GitHub และ Xbox ทำให้ Microsoft มีแรงจูงใจที่จะจัดการสิ่งเหล่านี้ภายในองค์กร
การเดิมพันในการแข่งขันนั้นมองเห็นได้จากแรงฉุดของ TypeSafe Diogo Almeida ซีอีโอของ TypeSafe โพสต์บน X ว่า "29.4% ของ Fortune 500 ปรากฏตัว" ในช่วงสามสัปดาห์นับตั้งแต่ Jev เปิดตัว โมเดลดังกล่าว "ให้บริการโทเค็นหลายล้านล้านต่อวันโดยไม่ได้ตั้งใจ" และเมื่อพิจารณาถึงปริมาณงานของทีมของเขาแล้ว "เป็นเวลา 3 สัปดาห์แล้วที่เราอยากจะนอนตอนนี้" สิ่งเหล่านี้เป็นองค์กรเดียวกันกับที่ Microsoft ขาย Azure ให้ ซึ่งทำให้การมาถึงของ Decision-1 เดิมพันในตลาดใหม่น้อยกว่าการป้องกันตลาดที่มีอยู่
---
ก้าวนำหน้า AIรับข่าวสาร AI การวิเคราะห์ และความก้าวหน้าล่าสุด ทั้งหมดในที่เดียว
อ่านข่าว AI เพิ่มเติม →

