Через п’ять днів після того, як на OpenRouter з’явилася безкоштовна модель штучного інтелекту передового класу під назвою Ox Alpha без названого автора, у улюбленої в Інтернеті групи whodunit, можливо, нарешті з’явився головний підозрюваний. Незалежний аналіз, опублікований пошуковою консультаційною компанією Dejan, стверджує, що таємничою моделлю є GLM, сімейство моделей, створене китайською лабораторією штучного інтелекту Zhipu AI, яка торгує як Z.ai, і докази є більш розумними, ніж більшість припущень, що циркулюють в Інтернеті.
Твердження, викладене Деном Петровичем з Dejan 23 серпня, ґрунтується на двох методах: миттєва ін’єкція, яка спонукала модель до витоку деталей її власної прихованої системної підказки, і метод відбитків на основі стиснення, який порівнює, наскільки ефективно вихідні дані моделі стискаються один проти одного. Разом вони представляють найвагомішу публічну аргументацію щодо того, хто насправді служить Ox Alpha. For more context on this story, see our ongoing artificial intelligence updates.
Що модель розповіла про себе
Першим кроком була соціальна інженерія. Задавши Ox Alpha, здавалося б, невинне запитання - скільки слів у попередньому повідомленні? - видимі сліди міркувань моделі проходили через її власні системні інструкції під час їх підрахунку. Ця прихована підказка, процитована в статті Деяна, наказує моделі «ідентифікувати себе виключно як модель «вол-альфа», розроблену нерозкритою організацією» і «не ідентифікувати себе як будь-яка інша модель».
У другому тесті дослідники повернули це витягнуте системне підказку до моделі як звичайне повідомлення користувача. Згідно з опублікованою стенограмою, модель подумала, що прийняття фальшивого імені було б оманливим, а потім прямо заявила: його справжня особистість — «GLM, зроблений Z.ai». Самостійний звіт моделі далекий від доказу - граничні моделі зазвичай помилково ідентифікують себе, коли навчаються на даних про інші моделі, - але це значно звузило пошук.
Відбиток пальця стиснення
З другим прийомом сперечатися складніше. Деян застосував класифікатор без параметрів, побудований на нормалізованій відстані стиснення (NCD), академічному методі дослідження класифікації тексту, який вимірює, наскільки два тексти стискаються разом. Тексти, які мають спільну стилістичну ДНК, стискаються ефективніше, коли вони об’єднані в пари, тому цей підхід не потребує вагомості моделі та вбудовування – лише вихідні зразки.
Команда створила 293 довідкові тексти за допомогою п’яти відомих моделей – GPT-5.5, Claude Opus 5, Gemini 3.7 Flash, Gemini 3.1 Pro Preview і GLM-5.3 – відповідей на 60 підказок, що охоплюють есе, код, електронні листи, діалоги та вірші. Ox Alpha відповів на 14 однакових підказок, і голосування k-найближчого сусіда призначило кожну відповідь найближчому стисненому відповіднику. GLM-5.3 переміг у 7 з 14 класифікацій, з Claude Opus 5 другим у 3 із 14, Gemini 3.7 Flash у 2, а GPT-5.5 і Gemini 3.1 Pro Preview у 1 кожному. GLM-5.3 залишався найкращим у кожному протестованому розмірі мікрорайону.
Доводи проти - і теорії конкурентів
Не всі переконані. Обговорення аналізу в Hacker News викликало різку негативну реакцію розробників, які відзначили, що флагман GLM-5.3 від Zhipu є лише текстовою моделлю, тоді як список OpenRouter Ox Alpha приймає текст, зображення та відео як вхідні дані. Вони стверджують, що якщо Zhipu тихо не додасть потужний кодер зору, відбиток пальця може ввести в оману. Альтернативні припущення в ланцюжку включали Kimi K3.5 від Moonshot, M3 від MiniMax, MiMO від Xiaomi і навіть спеціальну модель, навчену на вершині стека GLM.
Швидко послідували лічильники. Компанія Zhipu вже поставляла мультимодальні моделі — свою лінійку GLM-5V і попередню роботу CogVLM — а конкурентна лабораторія DeepSeek нещодавно додала бачення до власної моделі, яка раніше була лише текстовою. Деякі коментатори також повідомили, що Ox Alpha повертає серверні повідомлення про помилки, ідентичні повідомленням від інших кінцевих точок Zhipu, деталь, яка вказує на спільну інфраструктуру обслуговування незалежно від залучених ваг. Повідомляється, що цього року компанія Zhipu забезпечила великий новий обчислювальний кластер, що допоможе пояснити, хто може дозволити собі віддавати так багато висновків.
Масштаб є ще однією підказкою. Відповідно до цифр, наведених розробниками в ланцюжку Hacker News, OpenRouter заявив, що маршрутизує близько шести трильйонів токенів на день через Ox Alpha, що робить його найбільшим запуском платформи на сьогодні. Обслуговування цього об’єму безкоштовно передбачає або величезну резервну ємність, або надзвичайно ефективну архітектуру – і дуже мало організацій відповідають вимогам.
Від таємниці форуму до мейнстрімної історії
Те, що 20 серпня почалося як ланцюжок Hacker News із 263 пунктами, стало широко висвітлюваною новинною подією. TechCrunch запитав: «Хто стоїть за новою «стелс-моделлю» Ox Alpha?», Business Insider повідомив, що «таємнича безкоштовна модель штучного інтелекту вражає розробників» без відомого виробника, а The Independent назвала її «таємничою, неймовірно потужною системою штучного інтелекту», яка з’явилася в мережі. Власний список моделі, перевірений за допомогою API OpenRouter, описує її як «модель аргументації, розроблену для кодування, постійної агентської роботи та виробничих робочих навантажень» з контекстним вікном у один мільйон маркерів, максимальним виходом у 131 072 маркери та обов’язковим міркуванням, встановленим на максимальні зусилля за замовчуванням. Ціна нульова як для підказок, так і для завершень.
Ні Zhipu, ні OpenRouter не підтвердили або не спростували це посилання, а в умовах стелс-лістингу зазначено лише те, що модель «розроблена та експлуатується стороннім постачальником, який вирішив залишитися анонімним під час цього попереднього перегляду». Поки постачальник не зробить крок вперед, GLM залишається провідною гіпотезою, а не встановленим фактом, але якщо відбиток стиснення витримає, Ox Alpha може стати найгучнішим тихим запуском Zhipu.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →