同社は 2026 年 3 月に自動モードのテスト バージョンを初めて公開し、エージェント コーディング中の速度と制御のバランスを取る方法としてそれを売り込みました。 AI ツールがソフトウェア開発をどのように再構築するかに関するより広範な状況については、最新の AI 開発 を参照してください。
自動モードの仕組み
Claude Code が自動モードで動作する場合、各ステップで人間の承認を求めるプロンプトが表示されなくなります。代わりに、アクションが 「不可逆的、破壊的、または環境外を対象とした」 と判断されない限り、エージェントは独自に続行します。
つまり、日常的な編集、ファイル操作、コマンド ライン タスクは中断されずに実行されますが、システムは、データの削除、破壊的なコマンドの実行、開発者のローカル設定を超えたシステムへのアクセスなど、実際の損害を引き起こす可能性のある行為が行われる前に一時停止するように設計されています。
Anthropic 氏は、この変化を、人々が実際にツールをどのように使用するかに対する実際的な対応として枠組みを設けました。
決定の背後にあるデータ
Anthropic の発表で最も印象的な詳細は、同社が 1,053 人の有料テスターを対象に実施した調査です。同社によると、自動モードでは有害な行為の 89% を検出しましたが、人間による手動レビューでは 13.6% のみを検出しました。
アンスロピック氏は、コーディングセッションを繰り返すと人間の警戒心が急速に低下するという説明を示唆した。同社は、ユーザーがクロード コードの許可プロンプトの約 97% を承認していることを指摘しました。これは、プロンプトが有意義な安全性チェックではなく、ほとんどゴム印になっているということを意味します。
「手動レビューが習慣化すると、安全策ではなくなる」と同社の調査結果は示唆している。開発者が 100 回も「はい」をクリックすることに依存するのではなく、決定論的なルールで安全境界を自動化することで、実際にリスクを軽減できると Anthropic 氏は主張します。
新しい安全ガードレール
Anthropic 社は、デフォルトのスイッチに加えて、Claude Code に次のような新しい安全機能を追加していると述べました。
- プロンプト インジェクション スクリーニング。コードまたはドキュメントに埋め込まれた悪意のある命令を通じてエージェントを操作しようとする試みを検出するように設計されています。
- カスタマイズ可能なハード拒否ルール。これにより、組織はデータの引き出しや機密ディレクトリへの書き込みなど、特定のカテゴリのアクションを完全にブロックできます。
これらのコントロールは、自動モードであってもエージェントが上書きできない明確な境界を設定する方法をチームに提供することを目的としています。
エージェントコーディングへの賭け
クロード コード責任者 Boris Cherny は、X への投稿の中で、チームは数か月間自動モードのみを使用していると述べました。 「許可を求めるプロンプトに戻ることは想像できませんでした」と彼は書いている。
デフォルトの変更は、ソフトウェア開発の将来はエージェント、つまり AI エージェントが手作業を最小限に抑えて複数のステップのタスクを処理することになるという、より広範な業界の賭けを反映しています。 OpenAI、Meta などはすべて同じ方向を目指し、リポジトリや端末内でより自律的に動作するように設計されたコーディング エージェントを構築しています。
自動モードをデフォルトにすることは、その賭けを意味のあるエスカレーションにします。これにより、自律運用がオプトイン実験から、Anthropic の有料顧客 (個人の開発者から大規模企業チームにまたがる集団) の標準エクスペリエンスに移行します。
競争環境がエージェント的に進む
コーディングエージェントの自律性を高めることを推進しているのは、Anthropic だけではありません。 Meta は最近、大規模なリポジトリのターミナルで動作するように設計された AI コーディング エージェントである Muse Code を開始しました。 OpenAI といくつかの新興企業は、人間の介入を減らしながらエージェントがコードを読み取り、編集し、実行できるようにすることを目的とした同様のツールを構築しました。共通の軌跡は明らかです。業界はオートコンプリート形式の支援から、開発者に代わって有意義なアクションを実行できるシステムに移行しつつあります。
Anthropic の動きを際立たせているのは、オプトインではなく自主性をデフォルトにしようとする姿勢だ。ほとんどの競合ツールでは、依然としてユーザーがほとんどのハンズオフ モードをアクティブに有効にする必要があります。すべての有料アカウントのスイッチを切り替えることで、Anthropic は、自社のガードレールはそのまま使用しても信頼できるほど堅牢であると自信を持って主張し、その主張を証明または反証するための実世界のデータを大規模に収集しています。
信頼性の質問
この変化はまた、開発者がどの程度の監督権限を放棄するつもりなのかという疑問も生じさせる。 Anthropic のデータは、自動化されたガードレールが人間による習慣的なレビューよりも優れていることを示唆していますが、批評家は、デフォルトが行動を形成すること、そして自律性を前提としたデフォルトは、チームが十分に考慮していないレベルのリスクを静かに正常化する可能性があると警告しています。
Anthropic 氏の反論は、代替案 (ほぼ全員が無視する許可プロンプト) は、明確で強制力のあるルールを備えた自動化システムよりも劣悪なセキュリティ劇場である、というものです。
今のところ、同社はこのマシンに資金を投入している。 8 月 14 日から、Claude Code は疲れた開発者の反射的なクリックに対して自身の判断を信頼するようになります。
AI の先を行く
最新の AI 業界報道を入手 →AI コーディング ツールは急速に進化しています。 AI ニュースをもっと読む→
