美国国家安全局、网络安全和基础设施安全局以及联邦调查局在周二发布的一份咨询报告中联合指控六家中国人工智能公司对美国前沿模型进行工业规模的蒸馏活动。这些机构表示,至少自 2024 年底以来,DeepSeek、Moonshot AI、阿里巴巴、MiniMax、StepFun 和 Z.AI 从美国前沿人工智能模型(包括 Claude、GPT、Gemini 和 Grok 的变体)的数百万次交易和请求中提取了数十亿代币,该咨询称这一活动可能是在中国政府意识到的情况下发生的。
这份名为 AA26-251A 的咨询文件谨慎地指出,蒸馏是人工智能研究中一种合法且广泛使用的技术,即训练较小的模型来重现较大模型的输出。这三个机构所描述的内容有所不同:在工业规模上进行侵略性、恶意和有针对性的提炼,形成文件所说的目标公司人工智能发展战略的核心,而不仅仅是补充。有关最新的人工智能政策新闻,请关注 AI Buzz Wire 对华盛顿监管议程的持续报道。 最新人工智能政策新闻
谁被点名,以及他们据称拿走了什么
该咨询将特定活动归因于特定公司。据称,DeepSeek 至少自 2024 年以来就一直在开展有组织的蒸馏活动,目标是用于训练其 R1 和 V3 模型的推理能力、专门优化和特定领域功能。阿里巴巴被指控利用工业规模的蒸馏来改进其 Qwen 系列模型,该模型已成为世界上下载量最大的开放权重模型系列之一。
Moonshot AI、MiniMax、StepFun 和 Z.AI 同样被指控参与美国模型的恶意知识提炼,尽管该公告公布的这四家公司的具体细节较少。所有六家公司都建立了模型,现在可以在基准和价格上与美国前沿系统直接竞争。
据称这些活动是如何进行的
根据该文件,这些公司通过多种途径发送蒸馏请求,以获得未经授权的访问,同时违反了美国公司的使用条款。其中包括模型的本机应用程序编程接口、远程云提供商以及自动混淆用户元数据以避免检测的第三方聚合器。
这些机构还描述了一个被称为“中转站”的灰色代理市场,用于绕过美国提供商的地理限制、违反服务条款、逃避保障措施并破坏可追溯性。该咨询称,为了在如此规模的活动中降低成本,这些公司批量采购高级订阅,然后在开发团队之间共享。
更先进的策略包括思想链推理提取、阻止尝试期间访问路径之间的自动故障转移,以及旨在检测提供商何时部署防御对策的复杂质量评估框架。这些机构写道,这样做的回报是,进行工业规模蒸馏的公司在训练前沿模型时,人工智能开发时间明显缩短,财务支出减少。
对美国人工智能公司的三点建议
该咨询报告最后提出了美国人工智能提供商应立即采取的三项行动。首先,实施全面的检测和缓解:监控异常和恶意提示、帐户、网络和行为,并观察订阅使用率、新帐户的即时最大使用量以及企业规模的吞吐量模式。
其次,部署有针对性的应对变革。这些机构建议巧妙地改变对可疑恶意蒸馏尝试的响应,以削弱活动的回报——这是一种在不通知蒸馏者的情况下降低被盗产品价值的对策。
第三,建立跨组织情报共享,将模型提供商、云平台和 API 聚合器之间的活动关联起来,以便故意分布在多个提供商之间以避免单点检测的活动可以被识别为单个操作。
中美人工智能争端进入新阶段
该出版物发布之际,华盛顿对中国人工智能发展的言论更加广泛升级。路透社报道称,美国指责中国人工智能公司恶意抄袭美国人工智能技术,CyberScoop、Nextgov 和其他关注情报界的媒体周二报道了这一建议。该文件以明确的战略术语界定了利害关系,将这一活动描述为系统性提取威胁美国技术领先地位的专有功能和能力。
对于六家被点名的公司来说,该咨询提高了为西方客户提供服务的声誉和商业成本。阿里巴巴和 DeepSeek 尤其在中国境外培育了开发者生态系统,并且两者都出现在企业采购对话中,而这些对话现在将带来额外的合规问题。这六家公司都没有直接受到该咨询建议的约束——该文件针对的是美国人工智能公司——但其效果是将美国实验室两年来私下声称的内容正式化:他们的模型已被系统地大规模复制。
该建议还引发了人工智能行业内部一场悬而未决的争论,即合法学习在哪里结束,盗窃从哪里开始。从开放权重模型、已发表的研究和公共成果中提取是标准做法;该通报的作者对通过欺骗、规避访问控制和违反使用条款提取受限专有功能的行为划定了界限。如何通过技术对策、合同法或出口政策来执行这条界限,现在是行业及其监管机构必须回答的问题。
保持人工智能领先地位
随着模型安全政策之争的加剧,关注最新的人工智能发展和重大人工智能新闻。
阅读更多人工智能新闻 →