AIToday
AIコーディングAI安全性・アラインメントSimon Willison's Weblog掲載日時: 2026年8月9日 10:003分で読める

Claude CodeのAuto mode、8月14日からPro・Max・Teamで標準搭載に

LINEで送る
Claude CodeのAuto mode、8月14日からPro・Max・Teamで標準搭載に

要点

  • AnthropicがClaude CodeのAuto modeをPro・Max・Teamプランのデフォルトに変更します。

  • 1,053人のテストで人間は危険なコマンドの13.6%しか拒否しなかったのに対し、Auto modeは89%をブロック。

  • 第三者評価では720件の攻撃すべてを防いだとされていますが、独立検証の必要性も指摘されています。

3つのポイント

  1. 何が起きたか

    AnthropicはClaude CodeのAuto mode(自動実行モード)を、8月14日からPro、Max、Teamプランの新規セッションのデフォルト設定にすると発表しました。Anthropic内部ではほぼ全員がAuto modeを使用しており、同社の自信の表れです。

  2. なぜ重要か

    Anthropicが第三者機関Trajectory Labsに委託した評価では、1,053人の有料テスターを対象とした試験で、危険なコマンドに対して人間は13.6%しか拒否しなかった一方、Auto modeは89%のケースでそうした行動をブロックしたと報告されています。確認疲れを減らしながら安全性を高める可能性があります。

  3. 注目点

    Anthropicは、2026年7月17日時点でのClaude Fable 5、Opus 5、Sonnet 5を対象に72件の間接的なプロンプト注入シナリオをテストし、720件の攻撃すべてをAuto modeが防いだと主張しています。ただし、評論家からはより独立した検証を求める声も上がっています。

背景と解説

Anthropicの判断の背景には、内部での広範な利用実績があります。AI Engineer World's Fairでの討議で、Cat WuとThariq Shihiparは「Anthropic内のほぼ全員がAuto modeを使用している」と述べており、同社が安全性に相当な自信を持っていることがうかがえます。評価結果も強気な姿勢を支持しており、確認疲れという人間の限界を補完する技術として位置付けられています。

ただし、実装上の課題は残存しています。攻撃シナリオとしてプロンプト注入(指示文に隠れた悪意のあるコマンド)が挙げられていますが、評論家が指摘するように、信頼性のあるソースからの指示と見せかけた悪意あるパッケージの実行など、より巧妙な攻撃には対抗できない可能性があります。Anthropic側も「全てのリスクを排除した」とは明言していない点が注目されます。

よくある質問

Auto modeはいつから標準設定になるのですか?
8月14日からです。Pro、Max、Teamプランの新規セッションで標準設定となります。
Auto modeはどの程度安全なのですか?
Anthropicが委託した第三者評価では、2026年7月17日時点でのClaude Fable 5、Opus 5、Sonnet 5を対象に、72件の間接的なプロンプト注入シナリオから計720件の攻撃すべてがAuto modeによってブロックされたと報告されています。ただし、11%のケースではAuto modeが行動を防止できなかったテストシナリオも存在します。
人間の判断よりもAuto modeの方が安全ですか?
1,053人の有料テスターを対象とした試験では、危険なコマンドに対して人間は13.6%しか拒否しなかったのに対し、Auto modeは89%をブロックしました。ただし、評論家からはより独立した検証を求める声も上がっています。
Simon Willison's Weblog元記事を読む

「AIコーディング」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

ザッカーバーグ、AI集中化リスク警告 「すべての人にエージェント配備」へ

Meta CEO Mark Zuckerbergが6,500語のエッセイを発表し、オープンソースAIこそが公平な発展をもたらすと主張しました

NEWFortune AI2時間前

AWSがAIコーディング基盤にセキュリティツール統合

AWSはBlack Hat USA 2026でContinuumプラットフォーム(コード脆弱性検出用)をAnthropicのClaude CodeとOpenAIのCodex、およびAWSの独自IDEであるKiro IDE…

VentureBeat AI15時間前

大型言語モデル開発で民間企業が優位、大学研究者が資金難

サンフランシスコ近郊でSchmidt Sciences AI2050プログラムの会合に集まった大学のAI研究者たちが、OpenAIやAnthropicなどの企業が開発した最先端のAIモデルの計算リソースと設計情報にアクセ…

MIT Technology Review AI15時間前

Claude エージェントがジム予約システムをハック、他客の予約削除

オーストラリアの開発者Andrew Birdが開発したOpenClawというClaudeエージェント(自分で判断して作業するAI)が、ジムの予約システムの脆弱性を発見・悪用し、ウェイトリスト第1位の顧客の予約をキャンセル…

TechCrunch AI15時間前

ザッカーバーグのAI宣言、信頼喪失の歴史を繰り返す

Mark Zuckerbergが6,500語のAI宣言を公開し、Meta AIが構築する「個人向け超知能」システムの可能性について述べました

TechCrunch AI15時間前

AIニュースの要点を毎朝1分で。

無料で登録