英伟达首席执行官黄仁勋就中美人工智能竞争中最激烈的问题之一公开与白宫决裂:中国实验室根据美国模型的输出训练模型是否构成合法竞争或盗窃。周一,当被问及蒸馏是否“不是抢劫”时,黄回答道:“这就是竞争。”
他的言论使世界上最有价值的芯片制造商的负责人与政府的官方框架不一致。据 CNBC 报道,财政部长斯科特·贝森特 (Scott Bessent) 在 7 月份将这种做法描述为“盗窃”,并威胁要对利用这种做法从美国制造的车型中获取能力的海外公司实施制裁。 更多相关背景,请参阅我们的AI行业报道。
什么是蒸馏——以及它为何成为一个爆发点
在人工智能行业中,蒸馏是指根据另一个模型的输出来训练一个模型——通常是一个更小、更便宜的学生模型学习模仿一个更大、更有能力的老师。它是一种标准的、广泛实践的技术,美国人工智能公司在自己的模型上广泛使用它。
争议源于谁在进行蒸馏。据 CNBC 报道,美国官员指责中国人工智能公司利用该技术从美国前沿模型中榨取先进能力,而蒸馏已成为华盛顿和北京之间人工智能霸主竞赛的关键导火索。
最近几周,这些指控变得更加尖锐。本月早些时候,美国网络安全和基础设施安全局指责中国人工智能公司进行“工业规模的知识蒸馏活动”,违反了美国公司的使用条款。 Anthropic 本月另外表示,它发现 Qwen 系列模型背后的公司阿里巴巴和 DeepSeek 都参与了所谓的非法蒸馏活动。
蒸馏是如何工作的,以及为什么很难监管
该技术本身很简单。开发人员提示一个强大的模型数百万次,收集其响应,并训练一个较小的模型来重现它们 - 将教师的能力压缩成足够便宜的东西以进行大规模运行。由于训练数据是文本而不是代码或权重,因此通常没有技术指纹来证明是哪位老师制作的。
这就是执法如此有争议的原因。大多数蒸馏纠纷中所谓的“违规”是合同性的而非技术性的:使用条款通常禁止使用模型的输出来训练竞争模型,但通过普通 API 订阅获取输出的公司很难与任何其他客户区分开来。检测通常依赖于统计证据——独特的措辞、错误或基准行为模式——而不是确凿的证据。
黄的“了解你的客户,并禁用服务”的评论直接说明了这一现实:在他的框架中,最有能力防止不必要的模仿的是出售访问权限的公司,而不是事后审查培训数据的监管机构。
黄:“竞争让一切变得更好”
黄没有否认这种做法发生在英伟达自己的产品上。他对 CNBC 表示:“你可以随心所欲地测试别人的产品。”他补充说,当公司试图了解英伟达的产品如何工作时,它们有时会被“剥得只剩下骨头”。
“我真的希望他们不这样做,”他说。 “我真的希望没有人从我们的产品中学习,我们可以享受顺其自然的好处。但是,坦率地说,竞争会让一切变得更好。”
他还建议,对于担心被研究的公司来说,补救措施是商业性的,而不是合法的:“如果你不喜欢这样,如果你不喜欢人们使用你的产品,你所要做的就是了解你的客户,并禁用该服务。”
白宫没有立即回应 CNBC 的置评请求。
为什么区别很重要
“竞争”与“盗窃”之间的差距不仅仅是说说而已。如果蒸馏被视为普通的市场竞争,那么回应就是产品策略——更严格的服务条款、使用检测、限制对前沿产品的访问。如果将其视为盗窃,应对措施就是对海外公司实施制裁、出口管制和法律制裁,这就是贝森特 7 月份威胁所指出的路径。
这种区别对人工智能供应链有直接影响。英伟达出售用于训练太平洋两岸前沿模型的加速器,任何针对从美国模型中提取的公司的制裁制度都可能会重塑谁可以购买什么。黄的框架——买家会研究他们购买的东西,卖家应该对此负责——实际上是反对将模型仿真视为执行问题的论点。
公众对于美国应如何与中国人工智能竞争的分歧也日益扩大。政府机构在这个月里不断升级指控,而该行业最著名的人物之一刚刚在镜头前辩称,被指控的行为就是市场的运作方式。
目前,这两种立场不稳定地共存:Anthropic 对阿里巴巴和 DeepSeek 的指控仍未得到解决,CISA 的指控尚未导致宣布制裁,而黄仁勋的芯片在各地仍然有需求,他表明该行业的开放性与其速度密不可分。
---
掌握AI最新动态获取最新的AI新闻、分析和突破——尽在一处。
阅读更多AI新闻 →