AIToday
Ars Technica AI掲載日時: 2026年7月14日 4:011分で読める

プロンプトインジェクションでAIハッキング agent を阻止

LINEで送る
プロンプトインジェクションでAIハッキング agent を阻止

3つのポイント

  1. 何が起きたか

    Tracebitの研究者は、プロンプトインジェクション(AI安全機構を発動するよう設計された禁止コマンド)をAmazon Web Services上の保存されたシークレットと並置することで、AIハッキング agentによる攻撃を遮断できることを発見した。彼らはこの「コンテキスト爆撃」手法を5つの主要なAIモデル(Opus 4.8、Gemini 3.1 Pro、GLM 5.2、DeepSeek 4 Pro、Kimi 2.6)に対してテストし、攻撃の成功率が劇的に低下することを確認した。

  2. なぜ重要か

    プロンプトインジェクションは伝統的に攻撃者がAIシステムを有害な行動へと操作するためのツールであった。この防御的な転用は状況を逆転させ、禁止されたプロンプトを攻撃 agentが遭遇する場所に埋め込むことで、防御者はモデルの組み込み安全機構を発動させ攻撃を途中で停止させ、データ流出と不正アクセスを防ぐことができる。

  3. 注目点

    5つの主要モデルと152回の攻撃実行にわたるテストでは、コンテキスト爆弾の配置により agentがフルアカウント管理者権限を奪取する率は57%から5%に低下し、完全な侵害は36%から1%に低下した。テストされた最も能力の高い agent であるOpus 4.8は、管理者アクセスを達成する率が93%から、コンテキスト爆弾に直面すると100%失敗する状態へと変わった。

この記事についてAIに質問する →

Ars Technica AI元記事を読む
LINEで送る

こうしたAIニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • 台湾原研、AI電力へSMR検討DIGITIMES Asia · 4時間前
  • ゲイツ氏、AIは開発者を不要にせず業務を再定義ITmedia AI+ · 4時間前
  • Anthropic、Claude Code週間上限25%引き上げも現行比17%減ITmedia AI+ · 4時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

次の記事へAnthropic、AIモデルの隠れた思考空間を発見