Спільна попередня оцінка державних інститутів безпеки штучного інтелекту Сполучених Штатів і Сполученого Королівства дійшла висновку, що модель Moonshot AI з відкритою вагою Kimi K3 значно поступається провідним прикордонним моделям США в наступальних кіберзавданнях. Висновок, опублікований 25 липня 2026 року, додає конкретну точку даних до загострення дебатів про те, як слід ставитися до систем ШІ, розроблених Китаєм, коли вони отримують впровадження в Сполучених Штатах.

Оцінку оприлюднив Інститут безпеки штучного інтелекту США в NIST, відомий як CAISI, спільно з AISI Великобританії. Це одна з перших офіційних західних оцінок Kimi K3, зосереджена саме на кіберсфері. Для читачів, які стежать за динамічними новинами про [найновіші новини штучного інтелекту] (https://aibuzzwire.news), результат помітний не стільки для будь-якого окремого порівняльного результату, скільки через те, що він свідчить про розширення ролі державних лабораторій, які зараз відіграють у перевірці іноземних моделей перед їх широким розгортанням.

Що виміряно оцінюванням

Kimi K3, випущений компанією Moonshot AI у Пекіні, — це велика відкрита модель, яка швидко привернула світову увагу завдяки високій продуктивності загального призначення після її запуску. Його відкрите розповсюдження означало, що дослідники та розробники могли завантажувати та перевіряти ваги безпосередньо, що, у свою чергу, робило його природним кандидатом для зовнішнього тестування безпеки.

Новий попередній звіт зосереджується на більш вузькому та делікатному питанні: наскільки модель здатна виконувати наступальні кібероперації, завдання, які є найбільш важливими для органів національної безпеки? Замість того, щоб оцінювати Kimi K3 на основі широких знань або міркувань, інститути досліджували, чи може він допомогти здійснити кібератаки, використовувати вразливості програмного забезпечення чи іншим чином допомогти у зловмисних комп’ютерних операціях.

Цифри: приблизно 32% проти 76%

Результатом заголовка є різкий розрив. Згідно з оцінкою кібер-можливостей, Kimi K3 отримав приблизно 32%, тоді як провідні передові моделі США досягли приблизно 76%, згідно зі звітом про оцінку. Простіше кажучи, американські інститути виявили, що китайська модель може виконати лише близько третини наступальних кіберзавдань, які вирішували кращі західні моделі.

Кілька розеток, що покривають випуск, послідовно обрамляли розрив. Газета South China Morning Post повідомила, що Kimi K3 «значно відстає від конкурентів США у здатності до кібератак», а Interesting Engineering підкреслює розкид 76% проти 32% за кібертестами. Оцінка описується як попередня, тобто інститути сигналізують про те, що, ймовірно, будуть проведені додаткові тести, перш ніж будуть зроблені остаточні висновки.

Чому може існувати розрив

Модель, яка добре працює на загальних тестах, але слабко працює на кіберзлочинстві, представляє цікаву головоломку, і аналітики вже почали зважувати її. Пишучи в The Decoder, коментатори відзначили, що дистиляція може пояснити частину невідповідності.

Дистиляція — це техніка навчання, за якої модель навчається, імітуючи результати більш здібної моделі «вчителя», а не створюючи всі можливості з нуля. Як стверджують аналітики, якщо Kimi K3 був розроблений частково шляхом дистиляції, він міг би успадкувати межі своїх можливостей, встановлені будь-якою моделлю, яка служила його вчителем, потенційно обмежуючи продуктивність у найскладніших завданнях, таких як складні наступальні кібероперації.

Ця гіпотеза залишається лише такою, гіпотезою. У попередньому звіті не пояснюється, чому існує розрив, а лише те, що він існує. Інші можливі фактори включають навмисні обмеження можливостей, відмінності в навчальних даних або компроміси, зроблені для того, щоб модель була достатньо ефективною для роботи на широко доступному обладнанні.

Заряджений політичний фон

Оцінка припадає на середину ширшого поштовху США до ретельного вивчення китайських систем ШІ. Раніше в липні адміністрація Трампа відновила спроби обмежити використання моделей штучного інтелекту, розроблених Китаєм, у Сполучених Штатах, посилаючись на занепокоєння щодо кібербезпеки, при цьому Кімі К3 неодноразово згадувався в цій дискусії. Законодавці США окремо тиснули на американські компанії щодо наслідків інтеграції іноземних моделей у їхні продукти для безпеки даних.

На цьому тлі уряд виявив, що найвидатніша китайська модель відкритої ваги має низькі показники в нападах у двох напрямках. Для тих, хто виступає за обмеження, він надає офіційні докази того, що модель розглядається досить серйозно, щоб її можна було протестувати. Для тих, хто побоюється надмірних можливостей, порівняно низький кібер-оцінка також ускладнює розповідь про те, що кожна китайська модель представляє безпосередню кібер-загрозу.

Що це означає для всиновлення на відкритому повітрі

Результат також є джерелом окремої дискусії щодо відкритого штучного інтелекту в ширшому плані. Прихильники відкритих моделей стверджують, що ваги, які можна безкоштовно завантажити, дозволяють проводити незалежні тести на безпеку, схожі на ті, які проводили CAISI та AISI Великобританії, що робить відкрите розповсюдження позитивним для безпеки. Критики заперечують, що та сама відкритість знижує бар’єр для зловмисників, які можуть модифікувати або неправильно використовувати здатні системи.

У випадку з Kimi K3 доступність відкритої ваги — це саме те, що зробило можливим цю незалежну урядову оцінку. Те, чи заспокоїть чи насторожить відносно скромний кіберпоказ політиків, швидше за все, залежатиме не від самого числа, а більше від того, як агенції США та Великобританії вирішать сформулювати його в найближчі тижні.

Наразі попередня оцінка є точкою відліку: це перше офіційне західне вимірювання наступальних кіберздатностей Kimi K3, яке значно відстає від передових американських моделей, з якими його так часто порівнюють.

Будьте попереду ШІ

Оцінки кібер-можливостей — це лише один із фронтів у набагато більшій боротьбі за безпеку ШІ, регулювання та глобальну конкуренцію. Політичний ландшафт змінюється щотижня, і пропуск єдиної оцінки може означати, що ви втратите контекст за наступним заголовком. Читайте більше новин AI на AI Buzz Wire, щоб бути в курсі кожного важливого випуску моделі, урядового рішення та оцінки безпеки.

Будьте попереду змагань ШІ — відвідайте AI Buzz Wire