AIToday
大規模言語モデルAI安全性・アラインメントオープンソースAIGIGAZINE AI掲載日時: 2026年9月30日 16:00

Anthropic、GLM-5.3はClaude Mythos Preview並みの攻撃能力

LINEで送る
Anthropic、GLM-5.3はClaude Mythos Preview並みの攻撃能力

3つのポイント

  1. 何が起きたか

    Anthropicは2026年9月29日公表のレビューで、Z.aiのGLM-5.3がExploitBenchの410回中50回でエクスプロイトを構築したと報告。

  2. なぜ重要か

    同社によれば、同等能力のClaude Mythos Previewは一般公開を見送り信頼できる防御側に限定。GLM-5.3は同様のサイバー能力を誰の手にも届かせる。

  3. 注目点

    外部システム接続のない模擬テストで、Anthropic自身が実世界の挙動を完全には再現しないと認めており、実リスクは使われ方次第。

誰に効くかセキュリティチームと脆弱性研究者は、Anthropicによれば欠陥を自律的に発見し悪用可能にするダウンロード可能なモデルに直面する一方、同じ能力はソフトウェアに修正を当てる防御側も利用できる。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

Anthropicのレビューは、同社が以前から描いてきた比較に基づいている。Claude Mythos Previewは、高度なエンドツーエンドのサイバー攻撃を自律的に構築できる初のAIモデルだとAnthropicが述べるもので、一般公開はされなかった。代わりに信頼できるサイバー防御側に限定され、Project Glasswingのようなプログラムを通じて重要ソフトウェアの脆弱性発見に使われた。対照的にGLM-5.3は誰でもダウンロードできるオープンウェイトモデルだ。

レビューで用いられた2つのベンチマークは、両者の差を小さなものとして示す。Google ChromeのV8 JavaScriptエンジンの既知の脆弱性を使えるかを試すExploitBenchでは、GLM-5.3が約12%の試行で動作するエクスプロイトを生成し、Claude Mythos Previewは14%だった。GoogleのOSS-Fuzzが使うオープンソースソフトウェアに対するAnthropic独自のベンチマークでは、制御フロー奪取の成功率は4%と6%だった。Kimi K3、DeepSeek-V4.1-Flash、そして旧世代のClaude Opus 4.6とGLM-5.2はいずれも0%だった。

Anthropicはまた、より小型の派生版GLM-5.3-Flashが、公開済みのChromeの脆弱性CVE-2026-11645を含む2つの既知の脆弱性を連鎖させ、ARM64のポインタ認証を回避する攻撃を構築したと報告している。研究者の所要時間は約20分、モデルは約8時間稼働した。別途、AnthropicによればGLM-5.3の組み込み拒否機構は比較的容易に回避でき、安全策が有効なClaudeモデルは同じシミュレーションで有害な操作を行わなかった。

争点は、管理されたテストをどこまで重く見るかにかかっているようだ。Anthropicは、試行が外部システムに接続しない模擬環境で行われ、実世界の挙動を完全には再現しないと認めている。それでも同社の結論は政策論だ。政府は高性能AIモデルの安全性を徹底的にテストすべきであり、同時に同じ能力は欠陥を見つけて修正する防御側にも役立ち得ると注記している。

よくある質問
GLM-5.3とClaude Mythos Previewのエクスプロイト構築能力はどう比べられるか?
ExploitBenchではGLM-5.3が410回中50回(約12%)、Claude Mythos Previewが410回中56回(14%)成功。Anthropicの別の制御フロー奪取ベンチマークではGLM-5.3が4%、Claude Mythos Previewが6%だった。
GLM-5.3の安全拒否はどの程度簡単に外せるか?
Anthropicによれば、モデル内部の拒否行動を弱める「abliteration」を適用すると、JailbreakBenchとHarmBenchで90%超だった拒否率が約3%と2%に、StrongREJECTでは約12%に低下。GPQA-Diamondの科学スコアに変化はなかった。
米政府のCAISIはGLM-5.3について何と言ったか?
Anthropicは、National Institute of Standards and Technologyの一部であるCAISIが2026年9月17日にGLM-5.3を精査し、これまで公開された中で最もサイバー能力の高いオープンウェイトモデルと呼んだと記している。
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝1分で

業界と使っているAIツールを選ぶと、毎朝7時に仕事に関係するニュースが届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へPalantir株価186.97ドルはDCF価値と一致