Anthropic 宣布,从 2026 年 8 月 14 日开始,它将在 Claude Code 的 Pro、Max 和 Team 帐户中将自动模式设置为默认模式,这一转变意味着该公司的 AI 编码代理将越来越多地采取行动,而无需在每一步都暂停人工批准。 TechCrunch 于 2026 年 8 月 9 日报道了这一决定,The New Stack、9to5Mac 和 Tech in Asia 对此进行了报道,这是迄今为止最激进的押注之一,即自动监督可以胜过人工审查。有关重塑软件开发的人工智能工具的持续报道,请关注我们的人工智能行业报道。
这一变化重新定义了开发人员与其人工智能助手之间的关系。自动模式下的 Claude Code 不会在每个操作中显示权限提示,而是会自行继续,除非它确定某个操作是不可逆的、具有破坏性的或针对用户环境之外的操作。
决策背后的数据
Anthropic 的理由基于一组惊人的数字。在一项涉及 1,053 名付费测试人员的研究中,该公司报告称,自动模式捕获了 89% 的有害行为,而人工审核仅捕获了 13.6%。 Anthropic 认为,这种差距反映了人们监督 AI 的方式存在一个根本性弱点:用户批准了 Claude Code 中大约 97% 的许可提示,这使得手动审查变得只不过是一个条件反射的橡皮图章。
正如该公司在 8 月 8 日的公告中所解释的那样,人工审核可能会成为习惯,甚至变得毫无用处。当开发人员在每个会话中被中断数十次时,仔细评估每个提示的认知成本足够高,以至于大多数人只需单击“批准”即可。 Anthropic 的立场是,一个设计良好的自动化系统,不受人类疲劳和干扰,在实践中实际上可以更安全。
Claude 代码负责人 Boris Cherny 在 X 上写道,他和他的团队专门使用自动模式,并且已经这样做了好几个月,并补充说他无法想象回到权限提示。
自动模式实际改变了什么
Claude Code 是 Anthropic 的命令行和集成开发环境代理,旨在在开发人员的项目中编写、编辑和执行代码。在手动模式下,该工具会在执行接触文件系统、运行命令或发出网络请求的操作之前停止,等待明确的用户同意。
在自动模式下,代理具有更大的自主权。它将编写文件、运行测试、安装依赖项并执行脚本,而不会停下来询问 - 除非其内置保护措施将操作标记为潜在有害。 Anthropic 将其定义为速度与安全之间的平衡,认为快速移动而不持续中断的能力才是人工智能编码代理真正有用的原因。
该公司表示,它一直在并行添加安全功能,包括即时注入筛选和可定制的硬拒绝规则,这些规则可以让组织阻止特定类别的操作,例如试图窃取数据。
11% 的失误率及其批评
该决定引起了密切关注。正如 Tech in Asia 和其他媒体指出的那样,自动模式 89% 的捕获率意味着大约 11% 的有害操作会被漏掉,这一漏失率让一些开发人员和安全专业人员望而却步。当自主代理可以编写和执行代码时,即使是一小部分未经检查的有害操作也可能会产生真正的后果,从删除文件到将漏洞引入生产系统。
Anthropic的反驳是,相关比较并不是完美的,而是现实的替代方案。如果人类审核员在实践中发现的有害行为少于 14%,那么自动化系统发现的有害行为达到 89% 就代表了重大改进——即使它并非完美无缺。这场争论触及了人工智能安全中一个更深层次的问题:自主系统的标准是否应该是完美的,或者只是明显优于它们所取代的人类基线。
向代理人工智能的更广泛转变
克劳德代码默认更改反映了全行业向代理人工智能的发展——在现实世界中采取行动而不仅仅是生成文本的系统。 OpenAI、谷歌和许多初创公司正在构建浏览网络、管理数据库和控制应用程序的代理。这些产品中的每一个都必须应对自主与监督之间同样的基本紧张关系。
将自动化设为默认设置是一个有意义的信号。这表明至少有一个主要的人工智能实验室认为该技术已经足够成熟,生产力的提高超过了残余风险,并且用户将适应一个人工智能工具先行动后解释的世界。
对开发人员和团队的影响
对于开发团队来说,这种转变具有实际意义。自动模式可显着加快工作流程,特别是对于脚手架项目、编写样板文件和运行测试套件等重复性任务。但它也将安全负担转移到配置上——团队需要投入时间来设置硬拒绝规则并了解允许他们的代理在无人监督的情况下做什么。
尤其是企业客户可能面临着将自主代码执行政策正式化、平衡速度优势与合规性和安全性要求的压力。
保持人工智能领先地位
从提出建议的人工智能助手到采取行动的代理的转变是当今软件开发中最重要的转变之一。如需有关推动人工智能行业向前发展的工具、公司和辩论的清晰、来源报道,请为我们的主页添加书签并阅读更多人工智能新闻,网址为 https://aibuzzwire.news。
