Таємнича модель, яка цілий тиждень чарувала розробників під анонімним ім’ям Ox Alpha, тепер має офіційну особу. Китайська Z.AI запустила GLM-5.3-Flash, оригінальну мультимодальну відкриту модель, випущену за дозвільною ліцензією Массачусетського технологічного інституту, і компанія каже, що весь стелс-пробіг був виконаний на чіпах штучного інтелекту китайського виробництва. Запуск закриває одну з ігор у відгадування, яку найбільше стежать у індустрії ШІ цього року. Щоб дізнатися, як розгорталася історія, перегляньте останні розробки ШІ.
Що насправді відправив Z.ai
GLM-5.3-Flash — це суміш експертів із 320 мільярдами загальних параметрів і 18 мільярдами активних параметрів — помітне зниження порівняно з 32 мільярдами активних параметрів у його попереднику GLM-4.5. Згідно з повідомленням Z.ai, це перша нативна мультимодальна модель у сімействі GLM-5, яка підтримує введення тексту та зображень, і підтримує контекстне вікно, що досягає одного мільйона токенів.
Модель була навчена на мультимодальному корпусі з 30 трильйонами токенів, а її архітектура поєднує лінійну увагу до локальних залежностей із рідкісною увагою до глобального контексту. Компонент Z.ai, який викликає IndexPool, стискає групи векторів ключів індексатора, щоб обмежити затримку та використання пам’яті при великій довжині контексту. У порівнянні з GLM-5.3 компанія повідомляє, що обчислення займають утричі менше, а розмір кешу KV зменшено в 4,4 рази.
Порівняльні вимоги та ціни
За індексом штучного аналізу інтелекту версії 4.1.1 GLM-5.3-Flash отримав 57 балів — показник, який ставить його на вершину поточного рейтингу моделей Artificial Analysis, що значно перевищує середнє порівняльне значення 18. Z.ai каже, що він перевершує GLM-5.2 у зареєстрованих тестах кодування та агентських тестів за ціною в одну десяту та наближається до Anthropic. Claude Opus 4.8 у своєму внутрішньому тесті кодування. На DeepSWE v1.1 модель отримала 63,4 бала проти 46,2 для GLM-5.2; на AutomationBench він досяг 48,8 проти 26,2. Як зазначає TestingCatalog, різні системи оцінювання, контекстні обмеження та налаштування генерації означають, що порівняння перехресних тестів сильно залежать від кожного налаштування.
Ціноутворення позиціонує модель як агресивно дешеву: 0,15 дол. США за мільйон вхідних токенів і 0,50 дол. США за мільйон вихідних токенів із 83% знижкою швидкого кешу, відповідно до Artificial Analysis. Z.ai вказує на знижену вартість 0,045 доларів США за завдання Індексу інтелекту.
Китайський кут стружки
Найбільш стратегічно важливою деталлю є інфраструктура, а не розвідка. До запуску модель працювала анонімно як «ox-alpha» на OpenRouter і OpenCode, починаючи з 20 серпня, і Z.ai каже, що вона стала найпопулярнішою моделлю тижня в цих сервісах — трафік повністю обслуговувався вітчизняними китайськими прискорювачами. Щоб підтримати це, Z.ai створив стек обслуговування на основі SGLang, який розділяє кодування, попереднє заповнення та декодування, повідомляючи про потрійне збільшення продуктивності наскрізного обслуговування в десятках тисяч китайських мікросхем ШІ.
Це має значення не лише для одного постачальника. Це публічна демонстрація того, що прикордонна китайська модель може обслуговуватися в масштабах без апаратного забезпечення Nvidia, дані, які західні політики та виробники мікросхем не проігнорують. The New Stack підсумував випуск як дешевий, хороший і поданий на китайських фішках — три якості, про які досі рідко заявляли разом.
Відкриті ваги, реальне розгортання
Ваги доступні на Hugging Face за ліцензією MIT, а локальне розгортання підтримується через SGLang, vLLM і TokenSpeed. Передплатники плану кодування GLM отримують GLM-5.3-Flash у прямому ефірі з утричі більшою квотою, ніж у GLM-5.3, а його мультимодальні можливості розкриваються в ZCode через інтеграцію використання браузера та використання комп’ютера.
Візуальне мислення є центральним у випуску: Z.ai навчив модель перевіряти відтворені інтерфейси, ігровий процес і 3D-вихід, а потім оцінювати та переглядати власну роботу на основі візуального відгуку. Той самий підхід поширюється на документи, електронні таблиці, презентації та інформаційні панелі — хліб з маслом артефактів офісної роботи, саме в цьому конкурент Qwen, випуск якого того ж дня, також претендує на свої найбільші досягнення.
Рішення щодо відкритих ваг має значення для екосистеми, а не для любителів. Ліцензування Массачусетського технологічного інституту є найбільш дозволеною поширеною ліцензією в штучному інтелекті: комерційне використання, модифікація та розповсюдження не несе зобов’язань щодо копілефту. Незалежні хости можуть обслуговувати GLM-5.3-Flash на власному апаратному забезпеченні, точно налаштовувати його для вертикалей від юридичної перевірки до промислової автоматизації та вбудовувати його в продукти без узгодження умов — варіант, закритий передовими моделями лише з API.
Чому спрацював стелс-запуск
Анонімне розгортання дало Z.ai те, що не можна купити за маркетинговий бюджет: перевірку бренду. Розробники взяли на озброєння Ox Alpha, виходячи з його достоїнств, без обрамлення китайської лабораторії проти американських лідерів. На той час, коли Bloomberg підтвердив Z.AI як виробника, а Business Insider оголосив про «розгадану таємницю», модель уже очолювала таблиці лідерів спільноти на нейтральній території.
Конкурентний тиск тепер очевидний. Мультимодальна модель із контекстом одного мільйона токенів, вагами, ліцензованими Массачусетським технологічним інститутом, і ціною на продукцію в розмірі нижче долара змушує кожного чинного оператора виправдовувати свій прайс-лист. Межу Парето для співвідношення ціни та продуктивності — компроміс, який насправді відчувають розробники — було переглянуто, як це висловив про X Ендрю Керран, коментатор штучного інтелекту, який широко підтримується.
Відкритим залишається питання про довговічність: чи витримають переваги в еталонних тестах за умов конкурентного використання в реальному світі та як швидко західні лабораторії реагують на ціну. У будь-якому випадку, тиждень анонімних спекуляцій закінчився названою моделлю, вагами, які можна завантажити, і флотом обслуговування, який не використовує американський силікон.
---
Будьте попереду ШІОтримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.
Читати більше новин AI →