У повідомленні, опублікованому у вівторок, Агентство національної безпеки, Агентство з кібербезпеки та безпеки інфраструктури та ФБР спільно звинуватили шість китайських компаній штучного інтелекту у проведенні масштабних кампаній дистиляції проти прикордонних моделей Сполучених Штатів. Агентства кажуть, що DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun і Z.AI видобули мільярди токенів через мільйони бірж і запитів від прикордонних моделей штучного інтелекту США, включаючи варіанти Claude, GPT, Gemini і Grok, принаймні з кінця 2024 року. За словами консультантів, ця діяльність, ймовірно, сталася з відома китайського уряду.

У консультації, позначеній AA26-251A, обережно зауважують, що дистиляція є законною та широко використовуваною технікою в дослідженнях штучного інтелекту, у якій менша модель навчається відтворювати результати більшої. Те, що описують три агентства, відрізняється за своїм характером: агресивна, зловмисна та цілеспрямована дистиляція, що проводиться в промислових масштабах, утворюючи те, що в документі називається ядром, а не просто доповненням, до стратегії розвитку ШІ цільових компаній. Слідкуйте за останніми новинами політики AI Buzz Wire, що постійно висвітлюють вашингтонський регуляторний порядок денний. останні новини політики AI

Хто названий і що вони нібито взяли

Консультація приписує конкретні кампанії конкретним компаніям. Кажуть, що DeepSeek проводив організовані кампанії дистиляції принаймні з 2024 року, націлюючись на можливості міркування, спеціалізовані оптимізації та доменно-спеціальні функції, які використовувалися для навчання моделей R1 і V3. Компанію Alibaba звинувачують у тому, що вона використовує дистиляцію в промислових масштабах для вдосконалення сімейства моделей Qwen, яке стало одним із найбільш завантажуваних сімейств відкритих моделей у світі.

Moonshot AI, MiniMax, StepFun і Z.AI також звинувачують у зловмисній дистиляції знань про американські моделі, хоча в повідомленні публікується менше деталей щодо цих чотирьох компаній. Усі шість фірм розробили моделі, які зараз безпосередньо конкурують з американськими прикордонними системами за показниками та ціною.

Як нібито працювали кампанії

Згідно з документом, компанії направляли запити на дистиляцію кількома шляхами, щоб отримати несанкціонований доступ, порушуючи умови використання американських компаній. До них належать власні інтерфейси програмування додатків моделей, віддалені хмарні постачальники та сторонні агрегатори, які автоматично маскують метадані користувача, щоб уникнути виявлення.

Агентства також описують сірий ринок проксі-серверів, відомих як «станції передачі», які використовуються для обходу географічних обмежень провайдерів США, порушення умов обслуговування, ухилення від гарантій і підриву відстеження. Щоб знизити витрати під час кампаній такого масштабу, у повідомленні йдеться, що компанії займалися масовою закупівлею преміум-підписок, які потім розподіляли між командами розробників.

Більш просунуті тактики включали вилучення міркувань за ланцюжком думок, автоматичне перемикання збоїв між шляхами доступу під час спроб блокування та складні системи оцінки якості, призначені для виявлення того, коли постачальник застосував захисні контрзаходи. Виграш, як пишуть агентства, полягає в тому, що компанії, які проводять дистиляцію в промислових масштабах, бачать значно коротші терміни розробки штучного інтелекту та скорочення фінансових витрат при навчанні передової моделі.

Три рекомендації для компаній штучного інтелекту в США

Повідомлення завершується трьома негайними діями для американських постачальників штучного інтелекту. По-перше, запровадьте комплексне виявлення та пом’якшення: відстежуйте аномальні та зловмисні підказки, облікові записи, мережі та поведінку, спостерігайте за співвідношенням підписки та використання, миттєвим максимальним використанням з нових облікових записів і моделями пропускної здатності в масштабі підприємства.

По-друге, внесіть цілеспрямовані зміни відповіді. Агентства рекомендують тонко змінювати відповіді на ймовірні зловмисні спроби дистиляції, щоб пом’якшити результати кампаній — це форма контрзаходу, яка знижує вартість викраденої продукції, не попереджаючи дистилятора.

По-третє, установіть міжорганізаційний обмін розвідувальними даними, щоб співвіднести діяльність між постачальниками моделей, хмарними платформами та агрегаторами API, щоб кампанії, навмисно розподілені між кількома постачальниками, щоб уникнути одноточкового виявлення, могли розпізнаватися як одна операція.

Нова фаза суперечки щодо ШІ між США та Китаєм

Публікація з’явилася на тлі ширшої ескалації риторики Вашингтона щодо розробки штучного інтелекту в Китаї. Агентство Reuters повідомило, що Сполучені Штати звинуватили китайські фірми штучного інтелекту в зловмисному копіюванні американської технології штучного інтелекту, і у вівторок про це повідомили CyberScoop, Nextgov та інші видання, які слідкують за розвідувальною спільнотою. У документі ставки викладені в явно стратегічних термінах, описуючи діяльність як систематичне вилучення власних функцій і можливостей, що загрожує технологічному лідерству США.

Для шести названих компаній консультації підвищують репутаційні та комерційні витрати на обслуговування західних клієнтів. Alibaba та DeepSeek, зокрема, розвивали екосистеми розробників за межами Китаю, і обидва з’являлися в розмовах про корпоративні закупівлі, які тепер містили б додаткове питання відповідності. Жодна з шести компаній не підпадає під дію рекомендацій консультативної ради безпосередньо — документ стосується американських компаній зі штучного інтелекту, — але його ефект полягає в тому, щоб формалізувати те, про що американські лабораторії приватно заявляли протягом двох років: що їхні моделі систематично копіювалися в масштабі.

Порада також потрапляє в центр невирішеної дискусії в індустрії ШІ про те, де закінчується законне навчання і починається крадіжка. Дистиляція з відкритих моделей, опублікованих досліджень і публічних результатів є стандартною практикою; автори консультації підводять межу до вилучення обмеженої пропрієтарної функціональності шляхом обману, ухилення від контролю доступу та порушення умов використання. Питання, на яке галузь та її регулюючі органи мають відповісти, — як ця лінія забезпечується — за допомогою технічних контрзаходів, договірного права чи експортної політики.

Будьте попереду ШІ

Слідкуйте за останніми розробками штучного інтелекту та останніми новинами щодо штучного інтелекту, оскільки політична боротьба щодо безпеки моделей загострюється.

Читати більше новин AI →