谷歌 DeepMind 首席执行官 Demis Hassabis 提议仿效金融业监管局 (FINRA) 创建一个由美国主导的独立标准机构,在公开发布之前评估和监管前沿人工智能模型,并警告说,人类有一个“宝贵的窗口”来确保通用人工智能的安全开发。
在周二上午发布的一份题为“前沿人工智能框架和新时代黎明”的框架文件中,哈萨比斯提出了美国如何为最强大的人工智能系统建立可信监管基础设施的详细建议。该计划要求建立一个新的组织来测试前沿模型并为其部署开发最佳实践——由人工智能行业资助,但独立于任何一家公司运营。
为了了解最新的 突发人工智能新闻 和深入的政策分析,AI Buzz Wire 跟踪塑造行业的发展。
拟议的标准机构将如何运作
根据哈萨比斯的提议,人工智能实验室将自愿与标准机构分享其前沿模型,以便在公开发布前 30 天进行审查。这种部署前评估将评估模型的安全性和潜在误用风险。一旦评估协议被证明有效且稳健,该框架设想将流程正式化,以便前沿模型在部署到美国市场之前必须通过该协议。
该提案直接解决了最近政府对前沿人工智能系统审查所暴露的差距。今年早些时候,美国政府在 Anthropic 的 Mythos 模型和 OpenAI 的 Sol 模型各自发布之前对其进行了临时安全审查。这些审查因缺乏技术深度以及关于模型何时被认为足够安全而适合公共部署的决策不透明而受到严厉批评。
在哈萨比斯的框架下,这些决定将由一个由技术专家组成的专门组织处理,得到美国政府的支持,但不受政治压力。实验室还需要与标准机构合作,解决发布后发现的关键漏洞。
AGI 之前的“宝贵窗口”
在框架发布时接受 Axios、CNBC 和《经济学人》采访时,哈萨比斯强调,目前是在通用人工智能到来之前建立治理机制的绝佳机会。他将这一时期描述为“宝贵的窗口”——这意味着该窗口不会无限期地保持打开状态。
哈萨比斯长期以来一直是主动人工智能治理的倡导者。他的框架是在关于美国是否应该建立一个正式的人工智能监管机构以及如果是的话应该采取什么形式的激烈争论中提出的。 FINRA 模式之所以引人注目,是因为金融业的自律组织由成员公司资助,但在政府监督下运作,赋予其行业专业知识和公共责任。
特朗普政府的抵制
该提案面临重大政治阻力。特朗普政府对建立新的人工智能监管机构表示强烈怀疑。白宫人工智能顾问兼 a16z 普通合伙人 Sriram Krishnan(现已离职)公开驳斥了在行政部门内设立人工智能监管机构的想法,并直言不讳地表示“不会设立人工智能 FDA”。
这一立场使政府官员与一些业内最著名的领导人产生了分歧。尽管 Anthropic 和 OpenAI 等公司广泛支持部署前安全测试,但此类测试的机制和权威仍然存在争议。哈萨比斯的提案试图通过首先将标准机构定位为行业资助和自愿的方式来解决这个问题,只有在流程证明其价值后才会正式化。
以现有努力为基础
该框架并不是从头开始的。它建立在几家前沿人工智能公司已经就安全测试和红队做出的自愿承诺的基础上。它还借鉴了国际努力,包括英国人工智能安全研究所和七国集团广岛人工智能进程,它们已经建立了评估先进模型的初步框架。
然而,哈萨比斯的提议更进一步,呼吁建立一个资源充足的常设组织,并授权其在发布前测试每个前沿模型——当前机构没有提供这种程度的审查。 FINRA 的比喻表明,规模化、专业化的运作需要数百名技术专家,而不是一个小型的顾问小组。
该提案还涉及部署后监控,要求实验室与标准机构合作,处理模型公开后发现的漏洞。这反映出人们越来越认识到安全风险并不会在发布时就结束,几个备受瞩目的模型发布后出现的越狱和滥用案例就证明了这一点。
行业反应和后续步骤
该框架引起了人工智能政策界的高度关注。支持者认为,可靠的部署前测试制度可以建立公众对前沿模型的信任,并降低灾难性滥用的风险。包括一些自由市场倡导者在内的批评者警告说,强制测试要求可能会为小公司和开源开发商设置监管障碍,从而巩固大型企业的地位。
哈萨比斯的提案没有具体说明哪些模型符合“前沿”标准——这是一个决定未来监管制度范围的门槛问题。它还对标准机构如何处理机密或军民两用应用程序持开放态度,特别是考虑到最近人们对人工智能模型被用来破解美国机密系统的担忧。
该提议的时机是经过深思熟虑的。随着通用人工智能在未来几年内变得越来越可信,哈萨比斯强调必须现在就建立治理基础设施,而不是在危险能力出现之后才建立。华盛顿是否会按照他的呼吁采取行动还有待观察。
保持人工智能领先地位
如需全面了解人工智能政策、监管和行业发展,请访问 AI Buzz Wire。
阅读更多人工智能新闻 →


