Агентство национальной безопасности, Агентство кибербезопасности и безопасности инфраструктуры и ФБР совместно обвинили шесть китайских компаний, занимающихся искусственным интеллектом, в проведении кампаний по перегонке в промышленных масштабах против пограничных моделей США в опубликованном во вторник сообщении. Агентства заявляют, что DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun и Z.AI извлекли миллиарды токенов через миллионы бирж и запросов от пограничных моделей искусственного интеллекта США, включая варианты Claude, GPT, Gemini и Grok, по крайней мере с конца 2024 года, и, как говорится в сообщении, эта деятельность, вероятно, произошла с ведома правительства Китая.

В рекомендации, получившей обозначение AA26-251A, внимательно отмечается, что дистилляция является законным и широко используемым методом в исследованиях ИИ, при котором меньшая модель обучается воспроизводить результаты более крупной модели. То, что описывают три агентства, отличается по своему характеру: агрессивная, злонамеренная и целенаправленная перегонка, проводимая в промышленных масштабах, формирующая то, что в документе называется ядром, а не просто дополнением, стратегии развития ИИ целевых компаний. Чтобы быть в курсе последних новостей политики в области ИИ, следите за постоянными репортажами AI Buzz Wire о регуляторной повестке дня в Вашингтоне. последние новости политики в области ИИ

Кого зовут и что они предположительно забрали

Рекомендации приписывают конкретные кампании конкретным компаниям. Сообщается, что DeepSeek проводит организованные кампании по дистилляции, по крайней мере, с 2024 года, нацеленные на возможности рассуждения, специализированные оптимизации и специфичные для предметной области функции, которые использовались для обучения ее моделей R1 и V3. Alibaba обвиняют в использовании дистилляции в промышленных масштабах для улучшения семейства моделей Qwen, которое стало одним из самых загружаемых семейств моделей открытого веса в мире.

Moonshot AI, MiniMax, StepFun и Z.AI также обвиняются в злонамеренном извлечении знаний об американских моделях, хотя в сообщении публикуется меньше подробностей, специфичных для этих четырех компаний. Все шесть фирм создали модели, которые теперь напрямую конкурируют с американскими передовыми системами по показателям и цене.

Как предположительно работали кампании

Согласно документу, компании направляли запросы на дистилляцию несколькими путями для получения несанкционированного доступа, нарушая при этом условия использования американских компаний. К ним относятся собственные интерфейсы прикладного программирования моделей, удаленные облачные провайдеры и сторонние агрегаторы, которые автоматически запутывают метаданные пользователя, чтобы избежать обнаружения.

Агентства также описывают серый рынок прокси, известный как «пересадочные станции», используемый для обхода географических ограничений американских провайдеров, нарушения условий обслуживания, обхода мер безопасности и подрыва отслеживаемости. В сообщении говорится, что для снижения затрат во время кампаний такого масштаба компании занимались массовыми закупками премиальных подписок, которые затем распределялись между командами разработчиков.

Более продвинутые тактики включали извлечение логических рассуждений, автоматическое переключение между путями доступа во время попыток блокировки, а также сложные системы оценки качества, предназначенные для обнаружения того, когда провайдер применил защитные контрмеры. Выгода, как пишут агентства, заключается в том, что компании, проводящие перегонку в промышленных масштабах, видят значительно более короткие сроки разработки ИИ и сокращают финансовые затраты при обучении передовой модели.

Три рекомендации для американских компаний, занимающихся искусственным интеллектом

Рекомендации завершаются тремя немедленными действиями для американских поставщиков ИИ. Во-первых, внедрите комплексное обнаружение и смягчение последствий: отслеживайте аномальные и вредоносные запросы, учетные записи, сети и поведение, а также отслеживайте соотношение подписки к использованию, немедленное максимальное использование новых учетных записей и шаблоны пропускной способности в масштабе предприятия.

Во-вторых, разверните целевые изменения реагирования. Агентства рекомендуют слегка изменить реакцию на предполагаемые злонамеренные попытки дистилляции, чтобы уменьшить отдачу от кампаний — это форма контрмеры, которая снижает ценность украденной продукции, не предупреждая переработчика.

В-третьих, наладить обмен аналитическими данными между организациями для корреляции действий между поставщиками моделей, облачными платформами и агрегаторами API, чтобы кампании, намеренно распределенные между несколькими поставщиками во избежание обнаружения в одной точке, можно было распознать как одну операцию.

Новая фаза американо-китайского спора в области искусственного интеллекта

Публикация появилась на фоне более широкой эскалации риторики Вашингтона по поводу развития китайского искусственного интеллекта. Агентство Reuters сообщило, что Соединенные Штаты обвинили китайские компании, занимающиеся искусственным интеллектом, в злонамеренном копировании американских технологий искусственного интеллекта, и во вторник это сообщение было освещено CyberScoop, Nextgov и другими агентствами, следящими за разведывательным сообществом. В документе ставки сформулированы в явно стратегических терминах, описывая эту деятельность как систематическое извлечение запатентованных функций и возможностей, которые угрожают технологическому лидерству США.

Для шести названных компаний консультации повышают репутационные и коммерческие издержки обслуживания западных клиентов. Alibaba и DeepSeek, в частности, развивают экосистемы разработчиков за пределами Китая, и обе они фигурируют в переговорах по корпоративным закупкам, которые теперь вызывают дополнительный вопрос о соблюдении требований. Ни одна из шести компаний не подпадает под действие рекомендаций рекомендаций напрямую — документ касается американских компаний, занимающихся искусственным интеллектом, — но его эффект состоит в том, чтобы формализовать то, что американские лаборатории в частном порядке заявляли в течение двух лет: что их модели систематически копируются в больших масштабах.

Рекомендации также оказались в центре неразрешенных дебатов внутри индустрии искусственного интеллекта о том, где заканчивается законное обучение и начинается воровство. Использование моделей открытого веса, опубликованных исследований и общедоступных материалов является стандартной практикой; Авторы рекомендации подводят черту на извлечении ограниченного проприетарного функционала путем обмана, обхода контроля доступа и нарушения условий использования. Каким образом эта линия будет обеспечиваться – с помощью технических контрмер, договорного права или экспортной политики – теперь является вопросом, на который отрасль и ее регулирующие органы должны будут ответить.

Будьте впереди ИИ

Следите за последними разработками в области искусственного интеллекта и последними новостями в области искусственного интеллекта, поскольку политическая битва за безопасность моделей усиливается.

Читать больше новостей об искусственном интеллекте →