Y Combinator 首席执行官 Garry Tan 希望美国监管机构不要介入模型蒸馏不断升级的斗争,他认为美国人工智能初创公司应该可以在获得许可的情况下,自由地从美国前沿实验室中公开提取前沿模型。在本周发表的 CNBC 和 TechCrunch 采访中,谭表示,他对中国实验室提炼美国模型的回答很简单:“我什么也不做。”
“我们可以说,应该有一个美国的蒸馏制度,”谭本周早些时候告诉 CNBC,他建议较小的美国开放式人工智能实验室应该对美国前沿实验室使用与中国实验室被指控秘密进行的相同的培训技术。他告诉 TechCrunch,我们的目标是在美国建立一个更强大的开放权重期权生态系统,而不是最强大的公开可用模型来自中国的市场。有关塑造这场斗争的公司的更多信息,请关注我们的人工智能行业报道。
为什么蒸馏之战现在很重要
蒸馏是广泛提示一个人工智能模型以了解其工作原理和推理方式的做法,然后使用该知识来训练另一个模型。作为一种合法的培训技术,它在行业内很常见并被广泛接受,但如果未经许可、跨公司或跨国界进行,就会引起争议。
本周,Anthropic 发布了第二份报告,指控阿里巴巴、DeepSeek 和 Moonshot AI 等中国实验室对其 Claude 模型进行了大规模的“非法蒸馏攻击”——隐藏其身份,并在某些情况下依靠欺诈和窃取的凭证来获取访问权限,之后争论变得激烈。 Anthropic 首席执行官达里奥·阿莫迪 (Dario Amodei) 此前曾呼吁美国监管机构严厉打击这种做法,他的新文章呼吁加快人工智能发展步伐,敦促政策制定者打击威权国家公司未经授权的蒸馏行为,以此作为保持美国领先地位的核心部分。
Tan 的立场使他站在了该提议的对立面——这是一个明显的分歧,因为 Y Combinator 资助了许多基于前沿 API 的初创公司,并且仍然是硅谷最强大的加速器。
Tan 的两部分论证
需要明确的是,谭并不是为凭证被盗或身份欺诈辩护。正如他向 TechCrunch 阐述的那样,他的论点是双重的。
首先,他认为人工智能实验室规定客户如何处理他们的模型与他们共享的信息是过度的。 “控制用户和客户对封闭权重模型的 API 调用的行为感觉受到限制,”Tan 告诉 TechCrunch,“政府可以发挥作用,使这样一个事实正常化:获取经过广泛公共访问数据训练的情报本身也应该更多地是一种公共利益,而不是被限制在限制性服务条款后面。”
其次,他指出了此次打击行动的核心讽刺之处:专有实验室在收集训练数据时并未征求许可。众所周知,前沿模型在没有知识产权所有者许可的情况下吸收了大量的人类知识(包括受版权保护的材料),谭建议现在限制自己产出的实验室应该记住这段历史。
他提出的美国蒸馏制度将扭转当前的动态:中国实验室不再通过后门蒸馏美国模型,而是在前沿实验室的支持下,从前门邀请美国开放权重开发商,加强美国的开放生态系统,政策制定者担心美国的开放生态系统正在让位给 DeepSeek 和 Qwen 等模型。
一家公司的“噩梦场景”
谭将他的立场视为一种平衡,而不是对前沿实验室的攻击。他对 CNBC 表示:“他们处于前沿并推动其向前发展。” “我们希望它能够得到资助,并成为一个持续发展的伟大商业模式。你需要开放的权重模型来给人们自由和机会。”
但他保留了最尖锐的语言,以防注意力集中的风险。 “对于人工智能来说,噩梦般的场景、厄运般的场景是只有一家公司,”谭说。 “它拥有获得资本的最佳途径。它拥有最好的人工智能研究人员。它带着它逃跑了,突然间出现了一家公司。那将是糟糕的。”
这一框架颠覆了“人工智能毁灭者”的通常含义——这个标签通常是为担心存在风险的人保留的——并将其重新定位到市场结构。在谭的讲述中,值得担心的场景不是超级智能逃离实验室,而是所有人工智能的巨大力量落入单一专有提供商手中。
一场将定义下一个融资周期的辩论
这场争论不仅仅是一场哲学争论。 Anthropic 已开始直接执行其立场,有报道称,有账户终止和收紧服务条款的情况,旨在涉嫌蒸馏,而中国实验室则否认存在不当行为,并继续发布具有竞争力的开放重量版本。美国政府机构也被卷入了这个问题,政策制定者权衡出口管制、模型安全,以及现在是否应该允许美国初创企业学习美国前沿模型。
谭的介入让这场辩论中的自由重量派成为了备受瞩目的冠军,而此时正是人类最努力推动限制的时候。如果华盛顿响应 Amodei 的打击呼吁,Y Combinator 的投资组合(数千家其业务依赖于负担得起的前沿情报获取的初创公司)的反应可能会将利基培训技术转变为下一个人工智能融资周期的决定性政策斗争之一。
---
保持人工智能领先地位获取最新的人工智能新闻、分析和突破——尽在一个地方。
阅读更多人工智能新闻 →