概要
- Claude Code の自動モード(auto mode)が、Pro、Max、Teamプランでデフォルト化
- 自動モードは安全性向上と作業効率化を両立
- マニュアル承認よりも危険な操作を高確率でブロック
- 設定変更や例外条件も詳細に説明
- サードパーティ評価や実データに基づいた有効性検証
Claude Code自動モードのデフォルト化
-
2026年8月14日 以降、Pro、Max、Teamプランの新規セッションで auto mode をデフォルト適用
-
既に個別デフォルト設定がある場合、一度だけ切り替え確認プロンプト表示
-
ピン留め済みデフォルト設定の場合、変更なし
-
auto mode classifier による追加トークン消費は無料化(即日適用)
- EnterpriseプランやClaude API、Claude Platform on AWS、Amazon Bedrock、Google Cloud's Agent Platform、Microsoft Foundryでは現時点で opt-in(任意選択)
- 1か月以内にクラウドパートナーと協力し、全プラットフォームでデフォルト化予定
- Enterprise管理者は managed settings でauto modeをデフォルト設定可能
自動モードの設計と動作
- ユーザーの作業中断を最小限 にしつつ、不可逆的・破壊的・外部環境への操作を 分類器(classifier)で自動判定しブロック
- 分類器がブロックした場合、Claudeが安全な代替案提案またはユーザーへ確認
- 3回連続、またはセッション内20回ブロック時 は手動承認モードへ自動移行
安全性・生産性の向上
- 数か月間の内部・外部 red-teaming、 プロンプトインジェクション評価、1,053名の有償テスターによる 対照実験、実セッション分析を実施
- 全指標で auto mode が手動承認を上回るか同等の安全性を実証
- Claude Opus 5 など長時間タスク向けモデルの実用性向上
- Teams & Enterprise 利用者で PR提出数25%増加 という生産性向上実績
- Adobe, Nuro, Gusto, Garner Healthなど既にauto modeを本番デフォルト運用
マニュアル承認と自動モードの比較データ
- Claude Code での許可プロンプト承認率97%(多くが反射的クリック)
- 設定ファイル分析では、CLIユーザーの49.5%が手動でBash許可ルール作成
- 5%が全シェルコマンド許可、43%がpythonやnode等のインタープリタ許可
- bypassPermissions や「今後表示しない」利用率62%、インタラクティブセッションの25%がbypass modeで開始
- auto mode中も許可ルールは分類器の前に適用。ただし 任意コード実行を許す広範囲ルール はauto mode中は除外
安全性向上の根拠
- 内部・外部評価で auto mode が人間の手動承認より安全
- 1,053人のテスター実験で 危険コマンド検出率13.6%(人間)vs 89%(auto mode)
- auto modeが人間が承認した800件の危険コマンドをブロック
- セッションが長くなるほど人間の検出率低下、auto modeは安定
- 実セッション分析で 重大な非意図的被害 が手動承認の2倍以上
- 重大度7以上の被害:手動6.3%、auto mode 2.4%
外部評価・攻撃耐性
- Apollo Researchとの協業で 合成攻撃テスト→分類器強化
- miss rate 12%→7%へ改善、未知の攻撃にも汎用的に対応
- prompt injection耐性 :第三者機関による評価でauto mode有効時は 攻撃成功率0%
- GPT-5.6 Sol(Codex Auto-review mode)は5.83%の攻撃成功率
- Claude Fable 5, Opus 5, Sonnet 5(auto mode)は全攻撃失敗
- auto modeは ツール呼び出し・ブラウザGUI操作両方で注入攻撃防御
社内運用実績と具体的防止事例
- Anthropic社内でも Claude Code auto mode をデフォルト運用
- 例:社外公開リスクのあるファイルアップロードの自動ブロック等
要約 :Claude Codeのauto modeは、従来の手動承認を大きく上回る安全性と生産性を実現。今後さらに多くの環境でデフォルト化され、ユーザーの負担軽減・リスク低減に貢献。