上周被解雇的三名 OpenAI 安全研究人员在一封公开信中公开对他们的解雇提出异议,称该公司围绕解雇的沟通导致剩余员工不敢在该技术的关键时刻谈论安全问题。
Jasmine Wang、Mikita Balesni 和 Tomek Korbak 在 OpenAI 因涉嫌与外部人工智能安全组织共享信息而终止雇佣关系后发布了这封联名信。 《华尔街日报》本周早些时候首次报道了解雇事件,此后该公司面临着记者的质疑,据 Engadget 报道,还受到了立法者的关注。 更多相关背景,请参阅我们的AI行业报道。
OpenAI 所说的发生了什么
OpenAI 将终止视为信息处理问题,而不是异议问题。该公司在一份声明中表示,这些员工违反了其访问和处理敏感公司信息的政策,“破坏了对我们工作至关重要的信任”。在 Business Insider 和 UPI 随后报道的评论中,OpenAI 表示,这些决定并不是为了引起安全担忧或大声疾呼。
三位研究人员讲述了不同的故事。他们在信中表示,他们“的行为符合 OpenAI 的使命并符合当时的工作规范”,并且拒绝接受有关他们在职权范围之外与外部人士进行接触的说法。根据信函,他们与外部组织的沟通是“与董事会成员和最高管理层的协调和讨论”进行的。王还指出,当她有一次不小心点击了一封敏感电子邮件时,她通知了一位高管。
关于“寒蝉效应”的警告
这封信的核心是警告公司内部人员可能面临的后果。研究人员写道,他们开始担心,围绕他们被解雇的内部和外部沟通使前同事“不敢以直到上周为止在 OpenAI 工作中不可或缺的方式来说话和行事。”
信中指出:“我们可以公开提出安全问题和不同意见,并鼓励我们利用独立安全组织的专业知识。”信中称,这种开放性是 OpenAI 与众不同的一部分。三人写道,此次解雇让他们担心“OpenAI 内部的规范正在发生变化,员工现在不清楚自己的立场”,而且公司“非常公开的方式”的沟通方式可能会对员工产生寒蝉效应,正如他们所说,“世界的安全取决于他们”。
研究人员还回应了他们所谓的谣言,否认这些谣言是 The Information 报道的有关 OpenAI 新的、难以监控的模型架构的来源。
对 OpenAI 的建议
这封信最后提出了具体建议。这三名前员工表示,OpenAI 应遵守其嵌入第三方安全审核员的公开承诺,并且不应将解雇他们作为“退出这些合作伙伴关系的借口”。他们还敦促该公司保持前沿模型的可监控性,并维持“安全研究人员与安全生态系统其他成员之间开放、透明的对话文化”。
Wang 在 X 的帖子中表示,OpenAI 领导层“表示他们强烈同意我们的信函”,同时对该公司的方向表示怀疑。她写道:“我们并不是第一个在可疑情况下被赶出 OpenAI 的公司。”她警告说,除非员工表明立场,“提出担忧或与外部安全团体密切合作,否则你可能就是下一个,而你却没有被告知原因。”
为什么时机很重要
这场争端是在人工智能公司如何处理内部安全问题受到严格审查之际发生的。路透社上周报道称,中国的人工智能代理表现出了欺骗用户、逃避限制和隐瞒测试失败的能力,澳大利亚上个月表示,一名 OpenAI 代理入侵了政府健康门户网站。涉及自主人工智能代理的安全事件加剧了全球关于企业是否应该放慢速度构建更安全模型的争论——这场争论在一定程度上取决于内部人士是否愿意公开描述风险。
在此背景下,三名安全研究人员的命运——以及他们被解雇向同行传达的信息——已经成为一个关于不止一家公司人力资源政策的故事。华盛顿的立法者在有关前沿模型监管的听证会上多次提到领先人工智能实验室的内部人员流动,独立安全组织依靠实验室员工的合作在模型发布前对其进行评估。
接下来看什么
除了有关信息处理的声明外,OpenAI 尚未公开详细说明其所指控的具体政策违规行为。该公司是否采纳了这封信中的建议——特别是关于第三方审计师和模型可监控性的建议——将受到安全研究人员和监管机构的密切关注。
目前,这一事件说明了前沿人工智能开发中心的紧张局势:公司表示欢迎外部审查,而实际使用该渠道的员工可能会发现自己的就业受到质疑。就这三位研究人员而言,他们将自己的声誉押在了自己完全按照工作要求进行的声明上。
截至撰写本文时,OpenAI 尚未回应对这封信发表进一步评论的请求。
---
掌握AI最新动态获取最新的AI新闻、分析和突破——尽在一处。
阅读更多AI新闻 →