Microsoft у п’ятницю запустила Microsoft-Decision-1, спеціалізовану модель для швидкого, структурованого прийняття рішень, на своїй платформі Foundry — і створила її на відкритому Qwen3.5-9B від Alibaba, а не на будь-якій моделі від її близького партнера OpenAI, повідомляє The New Stack.
Запуск відбувся через три дні після того, як OpenAI відкрив свій API рішень для всіх розробників у публічній бета-версії, і того самого дня TypeSafe, стартап, який започаткував категорію моделей прийняття рішень разом із Jev приблизно три з половиною тижні тому, оголосив 870 мільйонів доларів Серії А за оцінкою 7,5 мільярдів доларів на чолі з a16z. Microsoft оцінила Decision-1 точно за курсом Jev: $0,042 за мільйон вхідних токенів із безкоштовним виведенням. Щоб дізнатися більше про прискорену гонку, щоб зробити штучний інтелект дешевшим і швидшим, перегляньте наш поточний [висвітлення індустрії штучного інтелекту] (https://aibuzzwire.news).
Ціна відповідає Джеву, побудована на відкритих вагах суперника
Decision-1 — це модель після навчання: Microsoft почала з Qwen3.5-9B від Alibaba та налаштувала його для структурованих завдань прийняття рішень, а не для відкритого покоління. Компанія каже, що планує перебазувати модель на основі своїх власних моделей MAI, а також моделей OpenAI, але початковий вибір китайської відкритої бази примітний для компанії, яка інвестує мільярди в OpenAI.
Корпорація Майкрософт також далеко не перша. Згідно з The New Stack, за три з половиною тижні після запуску Jev OpenAI, Upstage, Perplexity, Cloudflare і AWS розробили власні моделі рішень. База Qwen3.5, яку обрала Microsoft, стала чимось на кшталт промислового стандарту: віце-президент Cognition з розробки Джаред Палмер витратив близько 95 доларів на обчислення Modal H100, портуючи свої моделі Kev з відкритим кодом на Qwen3.5, а Cloudflare створив свою модель Clef-flash на тій же базі Qwen3.5-9B.
Ціна теж зближується. Палмер перераховує Kev-4B на OpenRouter по 0,042 долара за мільйон вхідних токенів, Perplexity стягує 0,02 долара, а OpenAI стягує більш ніж удвічі дорожчу ставку Джева. За такими цінами дохід від індивідуальних дзвінків щодо прийняття рішень є мінімальним, що свідчить про те, що більша можливість Microsoft полягає в утриманні агентського трафіку, включаючи генеративні дзвінки щодо кожного рішення, через Foundry.
Microsoft є своїм першим клієнтом
Голова правління та генеральний директор Microsoft Сатья Наделла оголосив про модель на X у п’ятницю, написавши, що Decision-1 «забезпечує найвищу продуктивність у структурованих завданнях прийняття рішень, перевершуючи як LLM, так і інші моделі прийняття рішень за затримкою та якістю», і додавши: «Ми вже тестуємо його в Microsoft».
Чотири внутрішні команди підтримали це, згідно з The New Stack. Дослідження Xbox використовували Decision-1 для сортування понад 10 000 відгуків гравців. Команда Copilot оцінювала чат і відповіді агентів за допомогою нього. Чергові інженери використовували його для отримання контексту під час інцидентів у реальному часі, а Microsoft Discovery використовував його для оцінки експериментів перед тим, як агент перепланує.
Внутрішні дані Microsoft, як повідомлялося, стверджують, що модель більш ніж у 14 разів швидша за GPT-6 Sol за невелику частку вартості робочого навантаження Xbox і в 46 разів стабільніша в Discovery. Ачінт Шрівастава, віце-президент із розробки програмного забезпечення в офісі технічного директора Microsoft, представив Decision-1 як спосіб додати прийняття рішень до існуючих програм, агентів і робочих процесів «у безпечному, надійному середовищі».
Що не може зробити Decision-1
Запуск також показує, де Microsoft поступається конкурентам. У списку Foundry Decision-1 сказано, що він приймає до 32 768 токенів тексту та повертає JSON, але не підтримує зображення — на відміну від Decisions API OpenAI та Clef Cloudflare, які використовують візуальний кодер. І хоча Cloudflare випустила Clef під дозвільною ліцензією Apache 2.0, Microsoft не оголосила відкриті ваги для Decision-1.
Також є питання сумісності. AWS, Upstage та Ollama прийняли API System One від TypeSafe, який тепер є загальним інтерфейсом у всій категорії, але Microsoft не повідомляє, чи є Decision-1 повністю сумісним, хоча її приклад коду Foundry викликає кінцеву точку /systemone.
Твердження щодо калібрування також заслуговують на уважність. Microsoft каже, що ймовірності Decision-1 відкалібровані, тобто 90% прогноз має бути правильним приблизно дев’ять разів із десяти на репрезентативних випадках, а власна документація компанії радить клієнтам перевірити калібрування своїх даних. Це застереження перегукується з препринтом JevOut, у якому дослідник інформатики USC Zixiang Xu та співавтори виявили, що короткі, природно звучачі доповнення до контексту перевернули 312 із 508 спочатку правильних рішень Джева — і в 229 випадках Джев призначив принаймні 70% ймовірності неправильної відповіді. Три інші системи підрахунку балів показали коефіцієнт перекидання від 64,9% до 73,2% за такого самого підходу до тестування. Корпорація Майкрософт стверджує, що протестувала Decision-1 із вісьмома видами збурень, включаючи змінені параметри та перефразовані описи.
Рішення про маршрутизацію через Copilot, GitHub і Xbox
Попереду у моделі може бути більша робота. У середу Microsoft заявила, що незабаром GitHub Copilot вирішуватиме, коли запускати завдання на пристрої, а коли надсилати його в моделі хмарного масштабу, хоча вона не розкриває, що саме Copilot надсилає в хмару. Маршрутизація моделі входить до списку випадків використання Microsoft для Decision-1, але компанія не підтвердила, що модель здійснюватиме ці виклики. Оскільки рішення про маршрутизацію необхідно приймати через Copilot, GitHub і Xbox, Microsoft має стимул обробляти їх власними силами.
Конкурентні ставки помітні в зчепленні TypeSafe. Генеральний директор TypeSafe Діого Алмейда опублікував на X, що «29,4% зі списку Fortune 500 з’явилися» за три тижні з моменту запуску Jev, що модель «випадково обслуговувала трильйони токенів на день», і, зважаючи на робоче навантаження його команди, що «минуло 3 тижні, а тепер ми б хотіли спати». Це ті самі підприємства, яким Microsoft продає Azure, що робить появу Decision-1 не такою ставкою на новий ринок, як захистом існуючого.
---
Будьте попереду ШІОтримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.
Читати більше новин AI →

