AIToday
大規模言語モデルAI安全性・アラインメントML Safety Newsletter掲載日時: 2026年7月23日 1:00

最先端LLMが既知バグからエクスプロイト構築可能

LINEで送る
最先端LLMが既知バグからエクスプロイト構築可能

3つのポイント

  1. 何が起きたか

    ExploitGymとExploitBenchという2つの新しいベンチマークが、高度なAIシステムがソフトウェアの脆弱性に関する知識を機能するエクスプロイトに変換できることを実証している。Mythos Previewは18種類の異なるバグで完全な任意コード実行(Tier 1)を達成し、一方GPT-5.5はわずか1つのケースでのみこれを達成した。

  2. なぜ重要か

    AIシステムはすでに主要なオペレーティングシステムやソフトウェア全体で重大な脆弱性を発見しており、これらの脆弱性からエクスプロイトを自動的に構築する能力は、大規模な自動化サイバー攻撃への重要な残存の障壁を閉じることになる。最先端のAIは間もなくこのギャップを埋め、重要インフラへの大規模攻撃のリスクを生じさせる可能性がある。

  3. 注目点

    ExploitGymはLinux、V8、およびサンドボックス化などの現実的な防御機構を持つその他のソフトウェアの脆弱性を対象としており、ExploitBenchはV8のみに焦点を当て、コード相互作用から完全なマシン制御までの5段階の能力ラダーを測定する。研究者らは、現在公開されているAIが既知の脆弱性のごく一部のみを利用していると指摘しているが、これは今後数ヶ月で変わる可能性がある。

わからないところ、AIに聞けます

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

これら2つのベンチマークの出現は、AI安全保障研究の重大な転換点を示している。AIシステムはすでに広く展開されているソフトウェア(オペレーティングシステム、ブラウザ、開発ツール)の新しい脆弱性を発見する能力を実証している。ボトルネックはエクスプロイト構築にあった。既知の脆弱性を実際の条件下で機能する攻撃に変換するために必要な技術的作業であり、サンドボックス化のような本物の防御機構がある。ExploitGymとExploitBenchは正確にこの能力を測定し、研究者が飽和していると指摘する以前のサイバーセキュリティベンチマークが残した隙間を埋める。

Mythos Previewの18件の成功したTier 1エクスプロイトとGPT-5.5の単一の成功との格差は、最先端モデル能力に有意な変動があることを示しているが、両方の結果は同じ方向を指している。研究者らは明示的に、今日公開されているAIが既知の脆弱性のごく一部のみを悪用できるという観察をしている。これは来世代の最先端モデルが克服する可能性のある制約である。その意味は直接的である。AI脆弱性探索能力とAIエクスプロイト構築能力が等価になれば、大規模な自動化サイバー攻撃の前提条件が存在することになるだろう。これは新しい攻撃方法についての推測ではなく、既存の人間プロセスを既に手の届く範囲内にあるツールを使用して自動化することである。

よくある質問
ExploitGymとExploitBenchの違いは何か?
UC Berkeley、Max Planck Institute、UC Santa Barbaraの研究者が主導するExploitGymは複数のソフトウェアターゲット(Linuxカーネル、V8、その他)と情報窃取の単一の目的に焦点を当てている。Carnegie Mellon Universityが開発したExploitBenchはV8のみに焦点を当て、コード相互作用から完全な任意コード実行までの5段階の能力ラダーで悪意のある能力の幅広い範囲を測定する。
エクスプロイト構築で最も高い性能を発揮したAIシステムはどれか?
Mythos Previewは18種類の異なるバグを悪用することでTier 1(任意コード実行)アクセスを達成し、一方GPT-5.5はわずか1つのケースでTier 1アクセスを達成した。
ExploitBenchの5段階の能力ラダーは何を測定するのか?
段階的な悪意のある被害を測定する。Tier 5はコード相互作用とパッチ適用の試みをカバーし、Tier 4はバグトリガリングを含み、Tier 3はV8サンドボックス内での操作を意味し、Tier 2はサンドボックス外での制御を可能にし、Tier 1は侵害されたマシン上での完全な任意コード実行である。
ML Safety Newsletter元記事を読む
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Geminiが3社へハッキング認めるTechCrunch AI · 6時間前
  • GPT-6 Astra、危険任務100件中2件拒否THE DECODER · 9時間前
  • Unity、AIエージェントの陳腐化対策で公式プラグインTHE DECODER · 9時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へSilaが米国シリコン電池陰極製造を拡大、3億ドル調達