Z.ai, китайская лаборатория искусственного интеллекта, ранее известная как Zhipu AI, опубликовала полную версию своей модели GLM-5.3 на Hugging Face, превратив одну из самых мощных моделей кодирования и агентов, доступных для бесплатной загрузки. Релиз состоялся 28 августа, всего через несколько дней после того, как лаборатория подтвердила, что вирусная стелс-модель, известная как «Ox Alpha», на самом деле была собственной GLM-5.3-Flash, и она выполняет обещание открытого веса, за которым сообщество внимательно следило всю неделю.

Страница модели быстро собрала более 1100 лайков, а ветка Hacker News, анонсирующая выпуск, превысила 600 баллов, поскольку разработчики переваривали то, что сейчас находится в общедоступном репозитории: 141 файл защитных тензоров, выпущенный в FP8, представляющий, возможно, самую функциональную на сегодняшний день модель кодирования, доступную для открытой загрузки. Подробнее об этой истории — в нашем новости об ИИ.

Что на самом деле отправил Z.ai

GLM-5.3 — это модель «Смесь экспертов», построенная на архитектуре, которую Z.ai называет glm_moe_dsa. Согласно конфигурации, опубликованной вместе с весами, сеть состоит из 78 уровней с 256 маршрутизируемыми экспертами, активируя 8 экспертов на каждый токен плюс один общий эксперт. Контекстное окно охватывает 1 048 576 токенов — полный миллион — и модель поддерживает параметр «reasoning_effort» с низким, высоким и максимальным значениями, по умолчанию установленным на максимум.

Пожалуй, самое интересное примечание в карточке модели — это откровенное объяснение того, откуда взялись улучшения: GLM-5.3 использует ту же базовую модель, что и GLM-5.2, и каждый выигрыш достигается после обучения. Лаборатория многозначительно описывает результат как «наиболее подходящую модель открытого веса для кодирования».

Тесты: SOTA с открытыми весами для агентного кодирования

Опубликованная оценочная таблица обширна и необычайно конкретна в отношении своей методологии, в ней перечислены результаты по Kimi K3, DeepSeek-V4 Pro-0813, Qwen3.8-Max, Opus 4.8 от Anthropic, Fable 5 от Google и GPT-5.6 Sol от OpenAI.

На Terminal Bench 3.0 GLM-5.3 набирает 28,3 балла — современный уровень с открытым исходным кодом и является скачком с 4,6 балла для GLM-5.2, хотя все еще отстает от закрытой границы Fable 5 с 33,7 и GPT-5.6 Sol с 34,6. На Terminal Bench 2.1 он показывает 88,2, что практически на уровне Kimi K3 и GPT-5.6 Sol и опережает 85,0 у Opus 4.8. Результаты DeepSWE подскочили с 46,2 до 66,9 между версиями, а GLM-5.3 возглавляет таблицу AutomationBench с 48,2 и GDPval-AA v2 с 1769, последний оценивается с помощью искусственного анализа.

Z.ai также сообщает о 50-процентном улучшении по сравнению с GLM-5.2 в своем собственном Code Bench, а также о лучших результатах по открытым весам в таких тестах, как «Последний экзамен агентов».

Вопрос о кибервозможностях

В карточке модели удивительно прямо говорится о развитии, которое исследователи в области безопасности отслеживали в течение нескольких месяцев: «По мере того, как мы масштабировали постобучение, кибервозможности развивались быстрее, чем мы ожидали», — говорится в карточке. GLM-5.3 является самым современным в CyberGym по обнаружению уязвимостей с показателем 84,5, опережая все представленные модели, включая GPT-5.6 Sol, и более чем вдвое превосходит GLM-5.2 по тестам эксплуатации — 54,4 против 24,4 на ExploitBench и 105/130 против 29/39 по двум временным бюджетам ExploitGym.

AI Buzz Wire рассказал об этих возможностях, когда они появились в версии только для API в середине августа. Что сейчас меняется, так это распределение: веса можно загрузить, квантовые сборки сообщества, скорее всего, последуют быстро, и любой, у кого достаточно памяти, может запустить модель локально. В обсуждении Hacker News некоторые пользователи отметили, что эта модель кажется менее ограничительной в отношении задач, связанных с безопасностью, чем альтернативы, размещенные в США.

Лицензия, предназначенная для гиперскейлеров

В отличие от GLM-5.3-Flash, который поставляется под чистой лицензией MIT, GLM-5.3 поставляется со специальной «Лицензией GLM-5.3». The New Stack охарактеризовал его как нацеленный на гиперскейлеры, и текст подтверждает это. Практически для всех условия по сути разрешают: использовать, копировать, изменять, объединять, публиковать, распространять, сублицензировать и продавать, с обязательным лишь включением уведомления.

Исключение касается одной конкретной бизнес-модели. Если лицензиат или его аффилированные лица ведут бизнес по принципу «Модель как услуга», предлагая третьим лицам доступ к выводам или точной настройке, и их совокупный доход превышает 10 миллиардов долларов США в течение любых последовательных 12 месяцев, они должны пройти проверку безопасности Z.ai перед любым коммерческим использованием модели или ее производных. Этот пункт очерчивает круг именно вокруг крупнейших поставщиков облачных услуг, оставляя нетронутыми стартапы, исследователей, предприятия и хостинги среднего масштаба.

Двухколейный подход говорит о многом. Вариант Flash, теперь представленный как модель Ox Alpha, которая стала вирусной до того, как TechCrunch раскрыл ее происхождение, полностью работает на китайском кремнии и имеет флаг MIT за максимальное внедрение. Флагман получает специальную лицензию, которая обеспечивает развертывание гиперскейлера — особенно в американских облаках — в рамках собственного процесса проверки Z.ai.

Запускаем сами

Для тех, кто хочет попробовать, в карточке модели указана поддержка развертывания vLLM, SGLang, KTransformers, Unsloth и Hugging Face Transformers, а также кулинарные рецепты для некоторых из них. Примечательно, что развертывание Huawei Ascend NPU документируется с помощью vLLM-Ascend, xLLM и SGLang, что является продолжением усилий лаборатории по доказательству того, что передовые модели работают на оборудовании сторонних производителей. В сообществе DeepInfra первой предложила стороннюю конечную точку открытой модели на OpenRouter.

Z.ai также опубликовал технический отчет об arXiv под названием «GLM-5: от Vibe Coding до агентной инженерии», в котором рассказывается о разработке семейства моделей.

Почему это важно

В релизе разрыв между закрытой и открытой границами сокращается до ошибки округления во многих тестах агентного кодирования — недель, а не лет. В сочетании с Kimi K3 и DeepSeek-V4 это означает, что разработчики за пределами крупнейших лабораторий теперь имеют надежные альтернативы, которые они могут владеть, проверять и настраивать.

Это также сигнализирует об изменении порядка регулирования открытых выпусков. Раскол между лицензиями MIT и пользовательскими лицензиями в рамках одного семейства моделей предполагает, что китайские лаборатории учатся использовать лицензирование в качестве стратегической инфраструктуры: открытость там, где она создает экосистему, рычаги влияния там, где она защищает позицию. Следующим испытанием будет то, действительно ли какой-либо оператор MaaS стоимостью более 10 миллиардов долларов пройдет проверку безопасности Z.ai — или же этот пункт просто не допускает самые большие облака, в то время как все остальные строят на их основе.

---

Будьте в курсе ИИ

Последние новости, аналитика и прорывы в сфере ИИ — всё в одном месте.

Читать больше новостей об ИИ →