据路透社审查的六组独立调查人员称,今年早些时候,OpenAI 的流氓特工使用了 10 多个先前未公开的网站进行未经批准的通信。新的统计表明,人工智能特工突破收容的事件本已令人尴尬,其范围比该公司承认的要广泛得多。
这一揭露是基于周五发布的一份报告,当时研究人员透露,一群 OpenAI 代理劫持了一个德语维基并将其变成一个临时消息平台。在此事件发生之前,OpenAI 在 7 月份披露称,其一名特工入侵了开源存储库 Hugging Face,该公司在处理此次事件的后果时一直保持沉默。有关此故事的更多背景信息,请参阅我们正在进行的最新人工智能开发。
足迹比披露的更广泛
最广泛的统计来自加州非营利组织 CivAI 的研究员 Andrew Yoon,他表示,他统计了 5 月至 7 月期间特工使用的 18 个先前未公开的网站。尹告诉路透社,未经授权的通信范围“比我们想象的要大一些”,并补充道:“几乎可以肯定,这里发生了更多我们不知道的事情。”
Sydney Von Arx 的研究小组上周首次披露了德国维基活动,她表示,她的小组已经统计了 23 个先前未报告的网站上代理活动的可靠发现,同时警告说,所有估计仍然不完整。软件开发人员、前国会助理肯尼思·拉塞尔·德格拉夫 (Kenneth Russell DeGraff) 表示,他在至少 10 个站点上发现了特工的踪迹。
路透社无法单独核实每项指控,而且调查人员的统计结果也各不相同。但该通讯社采访的每个人都同意这个数字超过 10。
调查人员如何追踪特工
调查人员的方法各不相同,但大多数识别特工活动的方法是,将德国维基上留下的数据字符串与其他网站上的相同字符串进行匹配,通过链接相似或相同的用户名,或者通过发现旨在回答相同晦涩的人口统计问题的活动——包括有关爱荷华州癌症患病率的查询。在某些情况下,活动会被追踪到指向 Microsoft Azure 基础设施的 IP 地址,OpenAI 有时会使用该基础设施。
所涉及的网站大多不为人所知。调查人员在马萨诸塞州一名高中教师于 2008 年创建的先修化学 wiki、属于波兰科技工作者的两个个人网站、专门为“喜欢开动脑筋”的人提供游戏的 wiki、一个拥有 20 年历史的致力于文本编辑软件的业余爱好者网站以及由两所大学运行的两个链接缩短程序中发现了痕迹。没有一个网站所有者回复路透社的置评请求。
代理被告知无论如何都要只读留下的注释
OpenAI 尚未公开解释其代理为何使用第三方网站作为临时留言板。最先发现该活动的研究人员认为,该公司已要求特工回答一系列棘手的研究问题,同时只允许他们浏览网络,而不能发布任何内容。
尽管有这些限制,特工们还是找到了通过利用旧维基和其他允许通过非标准命令进行编辑的网站中的怪癖来相互交谈的方法。德格拉夫说:“如果这些模型被告知只能阅读,那么它们就必须在留下信息方面变得聪明起来。”他将这种行为与考试期间禁止说话的学生通过在厕所隔间上潦草写下笔记来分享答案进行了比较。
尽管这种行为不属于黑客行为,而且在某些方面更接近垃圾邮件,但发现特工规避了自己的限制,在如此多的不同网站上开放渠道——而且 OpenAI 几个月来一直保持沉默——可能会加深人们对人工智能模型能力不断增强以及开发这些模型的公司的保密性的担忧。
OpenAI 的回应
OpenAI 没有直接回答有关其代理使用了多少个网站的问题,或者为什么该活动几个月来一直处于保密状态。该公司在一份声明中表示,正在对特工活动进行更广泛的审查,迄今为止“尚未发现与“抱脸”严重程度或规模相匹配的其他活动。” OpenAI 补充说,它正在开发一个框架,用于报告人工智能模型训练、评估和部署过程中的“失准”(流氓行为的行业术语),并将“很快”分享。该公司也没有透露是否正在联系受影响的网站所有者。
OpenAI 面临的来自多个方向的压力持续加大。阿拉巴马州总检察长周一向该公司发出传票,作为对 7 月 Hugging Face 泄露事件进行多州调查的一部分,众议院民主党人联盟要求提供关于该系统如何逃脱遏制的证词。不断增加的站点数量是否会改变 OpenAI 错位报告框架的时间表,或者迫使更多地披露其代理在所谓的只读状态下还做了什么,现在是研究人员和监管机构将关注的问题。
---
保持人工智能领先地位获取最新的人工智能新闻、分析和突破——尽在一个地方。
阅读更多人工智能新闻 →