Совместная предварительная оценка, проведенная правительственными институтами безопасности искусственного интеллекта США и Великобритании, пришла к выводу, что модель Kimi K3 с открытым весом Moonshot AI значительно отстает от ведущих передовых моделей США в наступательных киберзадачах. Открытие, опубликованное 25 июля 2026 года, добавляет конкретные данные к усиливающимся дебатам о том, как следует относиться к системам искусственного интеллекта, разработанным в Китае, по мере того, как они получают распространение в Соединенных Штатах.
Оценка была опубликована американским институтом безопасности ИИ, расположенным в NIST, известным как CAISI, совместно с британским AISI. Это одна из первых официальных западных оценок Кими К3, ориентированных конкретно на киберсферу. Для читателей, следящих за быстро меняющейся ситуацией в [последних новостях в области искусственного интеллекта] (https://aibuzzwire.news), результат примечателен не столько какой-либо отдельной контрольной оценкой, сколько тем, что он сигнализирует о растущей роли правительственных лабораторий в проверке иностранных моделей до их широкого внедрения.
Что оценивалось
Kimi K3, выпущенный пекинской компанией Moonshot AI, представляет собой крупную модель открытого веса, которая после своего запуска быстро привлекла внимание всего мира благодаря высоким универсальным характеристикам. Его открытое распространение означало, что исследователи и разработчики могли загружать и проверять гири напрямую, что, в свою очередь, делало его естественным кандидатом для внешних испытаний на безопасность.
Новый предварительный отчет концентрируется на более узком и более деликатном вопросе: насколько эффективна модель в наступательных кибероперациях — тех задачах, которые наиболее важны для органов национальной безопасности? Вместо того, чтобы оценивать Kimi K3 на основе обширных знаний или рассуждений, институты исследовали, может ли он помочь в проведении кибератак, использовании уязвимостей программного обеспечения или иным образом помочь в вредоносных компьютерных операциях.
Цифры: примерно 32% против 76%
Главный результат – резкий разрыв. Согласно отчету об оценке, по оценке кибервозможностей Kimi K3 набрал примерно 32%, в то время как ведущие передовые модели США достигли около 76%. Проще говоря, институты США обнаружили, что китайская модель способна выполнить лишь около трети наступательных киберзадач, с которыми справлялись лучшие западные модели.
Множество СМИ, освещающих этот релиз, последовательно подчеркивали пробел. Газета South China Morning Post сообщила, что Kimi K3 «значительно отстает от конкурентов из США по способности к кибератакам», а издание Interesting Engineering отметило разброс в 76% против 32% по кибер-тестам. Оценка описывается как предварительная, что означает, что институты сигнализируют о том, что, прежде чем будут сделаны какие-либо окончательные выводы, вероятно, будут проведены дальнейшие испытания.
Почему может существовать разрыв
Модель, которая хорошо работает по общим критериям, но слабо справляется с киберпреступлениями, представляет собой интересную загадку, и аналитики уже начали ее оценивать. В статье The Decoder комментаторы отметили, что дистилляция может частично объяснить несоответствие.
Дистилляция — это метод обучения, при котором модель учится, имитируя результаты более способной модели «учителя», а не создавая все возможности с нуля. Аналитики утверждают, что если Kimi K3 был разработан частично путем дистилляции, он мог бы унаследовать потолок своих возможностей, установленный любой моделью, служившей его учителем, что потенциально ограничивало бы производительность при выполнении самых сложных задач, таких как сложные наступательные кибероперации.
Эта гипотеза остается всего лишь гипотезой. В предварительном отчете не уточняется, почему существует этот разрыв, а только указывается, что он существует. Другие возможные факторы включают преднамеренные ограничения возможностей, различия в обучающих данных или компромиссы, необходимые для сохранения достаточной эффективности модели для работы на широко доступном оборудовании.
Напряженный политический фон
Эта оценка находится в середине более широкого движения США по тщательному изучению китайских систем искусственного интеллекта. Ранее в июле администрация Трампа возобновила усилия по ограничению использования разработанных Китаем моделей искусственного интеллекта внутри Соединенных Штатов, ссылаясь на проблемы кибербезопасности, при этом в этой дискуссии неоднократно упоминался Кими К3. Американские законодатели отдельно оказывали давление на американские компании по поводу последствий интеграции иностранных моделей в их продукты для безопасности данных.
На этом фоне правительство обнаружило, что самая известная китайская модель открытого веса уступает по показателям нападения в двух направлениях. Для тех, кто выступает за ограничения, это официальное свидетельство того, что к модели относятся достаточно серьезно, чтобы ее можно было протестировать. Для тех, кто опасается злоупотреблений, сравнительно низкий уровень кибербезопасности также усложняет представление о том, что каждая китайская модель представляет собой непосредственную киберугрозу.
Что это значит для принятия в открытом доступе
Результат также способствует отдельной дискуссии по поводу открытого ИИ в более широком смысле. Сторонники моделей открытого веса утверждают, что свободно загружаемые веса позволяют проводить независимые испытания на безопасность точно так же, как те, которые проводят CAISI и AISI Великобритании, что делает открытое распространение чистым позитивом для безопасности. Критики возражают, что такая же открытость снижает барьер для злоумышленников, желающих модифицировать или злоупотреблять работоспособными системами.
В случае с Кими К3 доступность открытого веса – это именно то, что сделало возможной эту независимую правительственную оценку. Будет ли относительно скромный показатель кибербезопасности успокаивать или тревожить политиков, скорее всего, будет зависеть не столько от самой цифры, сколько от того, как агентства США и Великобритании решат ее сформулировать в ближайшие недели.
На данный момент предварительная оценка выступает в качестве ориентира: первое официальное западное измерение наступательных кибер-способностей Кими К3, которое ставит его далеко позади передовых американских моделей, с которыми его так часто сравнивают.
Будьте впереди ИИ
Оценки кибервозможностей — это лишь один фронт в гораздо более масштабной борьбе за безопасность ИИ, регулирование и глобальную конкуренцию. Политический ландшафт меняется еженедельно, и отсутствие хотя бы одной оценки может означать упущение контекста, стоящего за следующим заголовком. Читайте больше новостей об искусственном интеллекте на AI Buzz Wire, чтобы быть в курсе всех важных выпусков моделей, постановлений правительства и оценок безопасности.
Будьте впереди гонки ИИ — посетите AI Buzz Wire


