
Anthropicは8月14日からClaude Codeの自動モードをデフォルト設定にする。このモードではAIが安全でないと判定されない限り自動的にコードアクションを実行する。
1,053人ユーザーの試験では、自動モードが有害行為の89%を検出したのに対し、手動レビューは13.6%にとどまった。
ユーザーが97%のプロンプトを習慣的に承認する傾向から、自動化された安全チェックが人間の習慣的な承認パターンを上回ることが示唆された。
何が起きたか
Anthropicは8月14日からPro、Max、Teamアカウントを対象に、Claude Codeの自動モードをデフォルト設定に切り替える。自動モードでは、システムが不可逆的、破壊的、またはユーザーの環境外を対象とした行為と判断されない限り、自動的にアクションを実行する。
なぜ重要か
1,053人の有料ユーザーを対象とした調査では、自動モードが有害行為の89%を検出したのに対し、手動レビューでは13.6%にとどまった。ユーザーが権限プロンプトの97%を習慣的に承認することが一因と考えられ、開発者の手動承認に伴う負担が軽減される。
注目点
変更は8月14日にPro、Max、Teamアカウントにロールアウトされる。Anthropicはさらに、プロンプトインジェクションスクリーニングとカスタマイズ可能なハードデニールールを導入し、データ流出に対する追加的なセーフガードを強化した。
Anthropicは金曜日、Claude CodeのオートモードをPro、Max、Teamアカウント全体のデフォルトに設定すると発表し、変更は8月14日に有効となる。3月にAnthropicが初めてテストした自動モードでは、Claude Codeが各ステップで人間の許可を求めるために一時停止するのではなく、自動的にコードアクションを実行できる。システムは不可逆的、破壊的、またはユーザーの環境外を対象とした行為だと判定されたアクションのみをブロックする。
同社の判断は実証的なテストに基づいている。1,053人の有料テスターを対象とした調査では、自動モードが有害行為の89%を検出したのに対し、手動レビューは13.6%にとどまった。Anthropicはこのパフォーマンスギャップの一部を人間の行動に帰している。ユーザーがClaude Codeで許可を求められると権限プロンプトの97%を承認することから、手動レビューは習慣的になり、ゲート機能を失うことが示唆される。Claude CodeのHead Boris Chernyはこの機能への信頼を強調し、X上で「チームと私は多くの月の間、自動モードのみを使用しており、許可プロンプトに戻ることを想像できません」とコメントした。
デフォルト設定への変更に加えて、Anthropicはプロンプトインジェクションスクリーニング(AIの入力に悪意のある指示を注入しようとする攻撃に対する防御)や、ユーザーが特定の種類のアクション(データ流出の試みなど)を明示的にブロックできるカスタマイズ可能なハードデニールールなど、追加の安全措置を導入した。これらのレイヤー化されたセーフガードは、ユーザーが各ステップを手動で承認する必要なく安全性を維持するために設計されている。
Anthropicが自動モードをデフォルトに切り替えるという決定は、コード生成AIがどのように安全性監視に対応すべきかについての根本的な考え方の転換を反映している。同社は3月に速度と制御のバランスを取る中間案として自動モードをテストしたが、自動モードが有害行為の89%を検出し、手動レビューはわずか13.6%にとどまったという実証結果は、自動化された安全チェックが実際に人間の判断を上回ることを示唆している。その差は顕著である。ユーザーは手動承認を求められると権限プロンプトの97%を習慣的に承認する傾向があり、この行動パターンは本来のゲートキーピング機能を無効化してしまう。これに対し、自動モードは何が不可逆的、破壊的、または境界を越えるものであるかについて一貫性のあるルールベースの基準を強制し、このユースケースにおいて人間の直感よりも信頼性が高い。
ロールアウトはまた、新しい安全レイヤーとタイミングを合わせている。プロンプトインジェクションスクリーニングとカスタマイズ可能なハードデニールールはデータ流出など特定の攻撃ベクトルを防ぐために設計されている。このレイヤー化されたアプローチ(人間のゲートキープに頼るのではなく、自動実行と明示的な安全ガードレールを組み合わせたもの)は、AI企業が開発者向けツールにおける信頼と監視についてどのように考えているかの転換を示している。
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できます
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
Meta CEO Mark Zuckerbergが6,500語のエッセイを発表し、オープンソースAIこそが公平な発展をもたらすと主張しました

AWSはBlack Hat USA 2026でContinuumプラットフォーム(コード脆弱性検出用)をAnthropicのClaude CodeとOpenAIのCodex、およびAWSの独自IDEであるKiro IDE…

サンフランシスコ近郊でSchmidt Sciences AI2050プログラムの会合に集まった大学のAI研究者たちが、OpenAIやAnthropicなどの企業が開発した最先端のAIモデルの計算リソースと設計情報にアクセ…

AIニュースの要点を毎朝1分で。
無料で登録