《纽约时报》、《纽约每日新闻》和一个媒体联盟正在要求联邦法官对 OpenAI 实施制裁,指控该公司故意隐瞒对具有里程碑意义的版权诉讼至关重要的证据,该诉讼可能会重塑人工智能公司如何根据记者的工作训练其系统。

周四在曼哈顿联邦法院提交的这份文件标志着一场法律战的急剧升级,这场法律战已成为人工智能行业与新闻业之间令人担忧的关系的象征。原告指控 OpenAI 在透明度上“选择了阻碍”,扣留了可能揭示其模型如何使用受版权保护的新闻文章的训练数据集和 ChatGPT 日志。

报纸的指控是什么

据美联社报道,报纸声称 OpenAI 从事“发现不当行为”,可能会扭曲审判中可用的证据。争议的核心有两点:用于训练 ChatGPT 的海量数据集,以及记录聊天机器人如何响应真实用户提示的日志。这些媒体认为,这些记录对于证明 OpenAI 的技术能够复制他们的新闻并与其竞争至关重要。

该动议声称,OpenAI 员工最近的证词直接与该公司之前关于可以和不可以在其系统中搜索什么的声明相矛盾。 《纽约每日新闻》律师 Steven Lieberman 表示,OpenAI 两年来一直在“歪曲”其识别人工智能训练数据和日志中受版权保护内容的能力。

据美联社报道,利伯曼表示:“这项动议要求法院惩罚 OpenAI,因为其隐藏和销毁了表明 ChatGPT 如何接受被盗新闻训练的证据。”他代表《每日新闻》及其七家姊妹报纸。

OpenAI 的回应

OpenAI 予以强烈反击,将这场纠纷描述为实力日渐衰弱的原告试图刺探普通用户的私人对话。在美联社报道的一份声明中,OpenAI 发言人 Drew Pusateri 表示,该公司已将其共享 ChatGPT 日志的限制描述为保护用户隐私的一项措施。

普萨泰里说:“随着《纽约时报》的案情减弱,他们被迫放弃对我们的指控,他们仍在继续努力侵犯与此案无关的人的隐私,包括提出这些公然虚假的指控。” “我们将继续捍卫用户的隐私和长期确立的合理使用原则。”

这场冲突凸显了人工智能诉讼中的一个核心紧张局势:最清楚地显示模型如何从受版权保护的文本中学习的技术记录也是记录公司最不愿意披露的,理由是商业秘密和用户隐私。

ChatGPT 热潮中诞生的案例

《纽约时报》于 2023 年底起诉 OpenAI 和微软,大约一年前,ChatGPT 首次公开亮相,引发了商业人工智能热潮,并开始重塑人们在线搜索信息的方式。该诉讼认为,在未经许可或没有补偿的情况下对数百万篇受版权保护的文章进行生成式人工智能的训练构成侵权。

2024 年,谷歌开始将人工智能生成的摘要置于搜索结果的顶部,出版商面临的威胁变得更加严重。这些概述可以直接回答用户的问题,从而切断转化为原始来源(新闻机构的经济命脉)广告收入的点击率。

此后,其他出版商也加入了《泰晤士报》的行列,其中包括《每日新闻》和《芝加哥论坛报》等媒体新闻集团旗下的报纸、数字媒体公司 Ziff Davis 以及非营利性调查报道中心。

更广泛的合理使用摊牌

制裁之战只是一场更广泛的法律战争的一条战线。 OpenAI 和其他人工智能开发人员坚持认为,使用从互联网上抓取的书籍、文章和其他文本来训练他们的系统受到美国版权法“合理使用”原则的保护。这一理论正在视觉艺术家、小说家、音乐唱片公司和其他创意产业提起的数十起诉讼中得到检验,迄今为止,法院得出的结论不一。

关注此案的法律分析人士指出,制裁动议即使被拒绝,也可能具有启发性。它们迫使双方准确解释哪些证据存在,哪些证据被保留,哪些可能已经丢失——这些细节往往在审判前被隐藏起来。法官对制裁请求的裁决也可能会影响未来人工智能版权诉讼的参与规则,确定公司必须提供多少关于其训练数据的透明度。

这场发现之争还凸显了结构性失衡,出版商称这种失衡有利于资金雄厚的科技公司。 OpenAI 得到了微软的支持,据报道正在准备公开募股,多年来拥有可以提起诉讼的技术基础设施和法律资源。许多报纸的利润已经微薄,它们认为,关于证据获取的旷日持久的争议本身就是一种耗尽时间的方式。

接下来会发生什么

负责此案的联邦法官现在将权衡 OpenAI 对所要求材料的处理是否上升到可制裁行为的水平。可能的结果包括经济处罚和不利推理指示(这将使陪审团认为缺失证据对 OpenAI 有害)以及对公司未来发现义务的更严格监督。相关版权主张的审判日期尚未确定。

对于已经在努力应对收入下降和新闻编辑室萎缩的新闻行业来说,其利害攸关。出版商认为,如果人工智能聊天机器人可以在没有署名或付费的情况下合成他们的报道,那么资助原创新闻的动力就会进一步减弱。

保持人工智能领先地位

如需持续报道版权之争、监管之争以及重塑人工智能格局的政策决策,请关注 AI Buzz Wire,获取值得信赖的报道。

阅读更多人工智能政策新闻 →