В пятницу Microsoft запустила Microsoft-Decision-1, специализированную модель для быстрого и структурированного принятия решений, на своей платформе Foundry и построила ее на открытом Qwen3.5-9B от Alibaba, а не на какой-либо модели своего близкого партнера OpenAI, сообщает The New Stack.

Запуск состоится через три дня после того, как OpenAI открыл свой Decisions API для каждого разработчика в публичной бета-версии, и в тот же день TypeSafe, стартап, который положил начало категории моделей принятия решений вместе с Jev примерно три с половиной недели назад, объявил о серии A стоимостью 870 миллионов долларов при оценке в 7,5 миллиардов долларов во главе с a16z. Microsoft установила цену Решения-1 точно по ставке Джева: 0,042 доллара за миллион входных токенов с бесплатным выходом. Дополнительную информацию об ускоряющейся гонке за удешевление и быстроту искусственного интеллекта можно найти в нашем постоянном освещении об отрасли искусственного интеллекта.

Цена соответствует цене Jev, создан на основе открытых весов конкурентов

Решение-1 — это модель после обучения: Microsoft начала с Qwen3.5-9B от Alibaba и настроила ее для структурированных задач принятия решений, а не для открытой генерации. Компания заявляет, что планирует перебазировать модель на свои собственные модели MAI, а также на модели OpenAI, но первоначальный выбор китайской базы с открытым весом примечателен для компании, которая инвестирует миллиарды в OpenAI.

Microsoft также далека от первопроходца. По данным The New Stack, за три с половиной недели с момента запуска Jev OpenAI, Upstage, Perplexity, Cloudflare и AWS выпустили собственные модели принятия решений. База Qwen3.5, выбранная Microsoft, стала чем-то вроде отраслевого дефолта: вице-президент Cognition по разработке Джаред Палмер потратил около 95 долларов на вычисления Modal H100, портируя свои модели Kev с открытым исходным кодом на Qwen3.5, а Cloudflare построила свою модель Clef-flash на той же базе Qwen3.5-9B.

Цена тоже сходится. Палмер размещает Kev-4B на OpenRouter по цене 0,042 доллара за миллион входных токенов, Perplexity взимает 0,02 доллара, а OpenAI взимает более чем вдвое больше, чем Jev. При таких ценах доход от отдельных вызовов принятия решений минимален, что говорит о том, что большая возможность Microsoft заключается в сохранении трафика агентов, включая генеративные вызовы вокруг каждого решения, проходящего через Foundry.

Microsoft — собственный первый клиент

Председатель и генеральный директор Microsoft Сатья Наделла анонсировал модель на X в пятницу, написав, что Decision-1 «обеспечивает максимальную производительность при решении задач структурированного принятия решений, превосходя как LLM, так и другие модели принятия решений по задержке и качеству», и добавив: «Мы уже тестируем ее в Microsoft».

По данным The New Stack, это подтвердили четыре внутренние команды. Xbox Research использовала Decision-1 для сортировки более 10 000 отзывов игроков. С его помощью команда Copilot оценивала чат и ответы агентов. Дежурные инженеры использовали его для извлечения контекста во время реальных инцидентов, а Microsoft Discovery использовала его для оценки экспериментов до того, как агент перепланирует.

Внутренние данные Microsoft, как сообщается, утверждают, что эта модель более чем в 14 раз быстрее GPT-6 Sol при незначительной стоимости рабочей нагрузки Xbox и в 46 раз более стабильна в Discovery. Ачинт Сривастава, вице-президент по разработке программного обеспечения в офисе технического директора Microsoft, представил Decision-1 как способ добавить возможность принятия решений к существующим приложениям, агентам и рабочим процессам «в безопасной, доверенной среде».

Чего Решение-1 не может сделать

Запуск также показывает, в чем Microsoft отстает от конкурентов. В листинге Foundry Decision-1 говорится, что он принимает до 32 768 токенов текста и возвращает JSON, но не поддерживает изображения — в отличие от Decisions API OpenAI и Clef от Cloudflare, которые используют видеокодер. И хотя Cloudflare выпустила Clef под разрешительной лицензией Apache 2.0, Microsoft не объявила открытые веса для Decision-1.

Также есть вопрос совместимости. AWS, Upstage и Ollama приняли API System One от TypeSafe, который теперь является общим интерфейсом для всей категории, но Microsoft не сообщила, полностью ли совместим Decision-1, хотя пример кода Foundry вызывает конечную точку /systemone.

Заявления о калибровке также заслуживают внимания. Microsoft заявляет, что вероятности Решения-1 калибруются, то есть прогноз на 90% должен быть верным примерно в девяти случаях из десяти в репрезентативных случаях, а в собственной документации компании клиентам рекомендуется проверять калибровку на своих данных. Это предостережение перекликается с препринтом JevOut, в котором исследователь компьютерных наук Университета Южной Калифорнии Цзысян Сюй и его соавторы обнаружили, что короткие, естественно звучащие дополнения к контексту перевернули 312 из 508 изначально правильных решений Джева — и в 229 случаях Джев приписал неправильному ответу не менее 70% вероятности. Три другие системы оценки показали процент провалов от 64,9% до 73,2% при том же подходе к тестированию. Microsoft заявляет, что протестировала Решение-1 с восемью видами отклонений, включая переупорядоченные параметры и перефразированные описания.

Решения о маршрутизации в Copilot, GitHub и Xbox

Возможно, у модели впереди большая работа. В среду Microsoft заявила, что GitHub Copilot скоро решит, когда запускать задачу на устройстве, а когда отправлять ее в модели облачного масштаба, хотя она не раскрыла, что Copilot отправляет в облако. Маршрутизация модели входит в число вариантов использования, которые Microsoft перечисляет для Решения-1, но компания не подтвердила, что модель будет выполнять эти вызовы. Поскольку решения о маршрутизации между Copilot, GitHub и Xbox приходится принимать, у Microsoft есть стимул обрабатывать их собственными силами.

В успехе TypeSafe очевидны конкурентные ставки. Генеральный директор TypeSafe Диого Алмейда написал на X, что «29,4% компаний из списка Fortune 500 появились» за три недели с момента запуска Jev, что модель «случайно обслуживала триллионы токенов в день» и, учитывая рабочую нагрузку своей команды, что «прошло уже 3 недели, и теперь мы хотели бы спать». Это те же предприятия, которым Microsoft продает Azure, что делает появление Decision-1 не ставкой на новый рынок, а защитой существующего.

---

Будьте впереди ИИ

Получайте последние новости, анализ и открытия в области искусственного интеллекта — все в одном месте.

Подробнее новости AI →