Anthropic 已开始要求 Claude 用户自愿分享他们的语音对话,以帮助训练和改进其人工智能模型。据 BleepingComputer 报道,当人们使用 Claude 的语音功能并明确请求使用其语音数据进行训练的许可时,就会出现新的提示。

提示中写道:“允许我们使用您的语音数据来改进我们的人工智能模型”,随后解释说“录音和语音聊天数据有助于改善人类人工智能模型理解和响应语音的方式。随时在设置中关闭此功能或删除此数据。”用户现在可以选择“允许”或“不允许”,并且以后也可以通过 Claude 隐私设置中的专用开关来管理该请求。如果您正在跟踪主要人工智能实验室如何处理用户同意,这是主流助手中细粒度、可逆数据控制传输的更具体示例之一。有关更多背景信息,请参阅我们对最新人工智能发展 的报道。

单独的语音开关

最值得注意的细节是,语音训练与 Anthropic 现有的使用聊天和编码会话来改进模型的选项分开处理。这意味着用户可以允许 Anthropic 训练他们的语音对话,同时将常规聊天和 Claude Code 会话排除在训练之外,反之亦然。

在“设置”>“隐私”中,Anthropic 将该选项描述为“允许我们使用您的语音数据”,并附有支持文字:“对于批准的会话,允许使用您的录音和语音聊天数据来改进 Anthropic AI 模型。”

据 BleepingComputer 称,该设置在该商店查看的界面中默认处于禁用状态,因此 Anthropic 不会自动将用户注册到语音数据共享中。选择加入的人也可以稍后关闭该选项,该公司表示可以随时从设置中删除语音数据。

为什么语音数据对训练很重要

语音是一种与文本根本不同的数据类型。语音带有口音、节奏、情感和背景噪音,所有这些都很难令人信服地合成,而且标记起来也很昂贵。对实验室来说,进行真实对话训练是让语音助手听起来更自然、优雅地处理干扰并从误听中恢复的最直接方法之一。

该值正是语音数据敏感的原因。某人说话的录音本质上是生物识别的,可以揭示说话者从未打算分享的信息,并且经常捕捉到房间里从未同意任何事情的其他人。一些司法管辖区的监管机构对待录音的态度比对待文本更加谨慎,任何对录音的不当处理往往都会引起大规模的审查。

通过使语音切换与一般的培训选择不同,Anthropic 承认用户可能需要针对不同数据类型的不同规则。这是注重隐私的用户长期以来一直要求的一种设计选择:每个类别都可以根据自己的条件进行评估,而不是将文本、代码和音频捆绑在一起的一揽子开关。

默认选择加入,但有要求

此次推出也反映了行业重心的转移。在聊天机器人的早期时代,用户对话经常被用来进行训练,没有什么仪式感。一波用户强烈反对、监管关注和企业客户要求推动主要实验室选择退出控制,在某些情况下选择默认敏感数据。

Anthropic 的方法坚定地站在选择加入阵营:除非用户主动允许,否则不会共享任何内容,在有人使用语音功能时会显示提示,并且可以在设置中撤销。批评者仍然会指出,产品流程中出现的提示往往会转化大量用户,并且对于希望该功能正常运行的人来说,单击“允许”的实际压力是真实存在的。

该公司自己的措辞试图通过强调可逆性来消除这些担忧:数据可以随时关闭或删除,并且权限仅限于已批准的会话,而不是视为永久授予。

用户应该知道什么

对于 Claude 用户来说,实际的收获很简单。如果您使用克劳德的语音功能,预计会看到提示。如果您拒绝,语音功能本身不会发生任何变化;您根本不会为培训提供录音。如果您接受但后来改变了主意,控件位于“设置”>“隐私”中,其中语音切换位于现有的聊天和克劳德代码培训选项旁边。

任何对音频特别谨慎的人还应该记住,语音数据共享(如聊天训练)是可以重新考虑的选择。故意检查一次隐私设置比在出现提示时做出反应更好。

对于业界来说,此次推出是人工智能实验室与其用户之间正在进行的关于谁利用其数据资助模型改进的谈判中的另一个数据点。语音助手正在成为人工智能的主要界面,而公司现在索取语音数据的方式将在未来几年影响用户的期望。 Anthropic 版本的要价是透明的、分段的和可逆的,这比行业几年前遇到的标准更高。这是否成为标准模板,或者进一步提高底线,将取决于竞争对手如何处理同样的问题,以及监管机构如何权衡通过消费者人工智能产品收集的生物识别数据。

---

保持人工智能领先地位

获取最新的人工智能新闻、分析和突破——尽在一个地方。

阅读更多人工智能新闻 →