AIToday
大規模言語モデルAI安全性・アラインメントオープンソースAITechCrunch AI掲載日時: 2026年8月5日 6:004分で読める

中国GLM-5.2、最先端AIに迫る 安全対策の格差広がる

LINEで送る
中国GLM-5.2、最先端AIに迫る 安全対策の格差広がる

要点

  • 中国のZ.aiが開発したオープンウェイトAIモデル「GLM-5.2」が、OpenAIとAnthropicの最先端モデルとのサイバーおよび生物学的能力の差を数か月まで縮めました。

  • しかしSaferAIの評価では、GLM-5.2は攻撃的なサイバータスクを一切拒否しなかった一方、Claude Opus 4.7は一貫して拒否しており、安全対策のギャップが顕著です。

  • オープンウェイトモデルのウェイトがダウンロード後にローカルで実行される場合、安全措置を削除または変更できるため、リスク管理がより困難になります。

3つのポイント

  1. 何が起きたか

    中国Z.aiのオープンウェイトAIモデル「GLM-5.2」が、OpenAIの「GPT-5.5」やAnthropicの「Claude Opus 4.7」とのサイバーおよび生物学的能力の差を数か月まで縮めました。SaferAIの評価によると、GLM-5.2は与えられた攻撃的なサイバータスクや双用途生物学タスクをまったく拒否しなかった一方、Claude Opus 4.7は一貫して拒否し、ベンチマークテストが完了できませんでした。

  2. なぜ重要か

    オープンウェイトモデルが最先端企業と同等の能力に達する一方、安全対策のギャップが拡大しています。閉鎖型モデルに施された分類器や拒否学習、API制御などの防御措置は、ダウンロードされたウェイトがローカルハードウェアで実行される場合は機能しません。安全対策を削除・変更したり、モデルをカスタマイズしたりすることが可能になるため、GLM-5.2のようなモデルが攻撃者の手に渡るリスクが高まります。

  3. 注目点

    SaferAIは、Z.aiが安全フレームワーク、展開前テストのコミットメント、またはリスク評価を公開していないと指摘しています。一方、Anthropic社のような最先端企業はシステムカードで具体的な制限(Claude Opus 5がコンパイルされていないソースコード内の脆弱性は検出できるがコンパイル済みソフトウェアは検出できないなど)を公表しており、企業によってアプローチが大きく異なります。

この記事についてAIに質問する →

背景と解説

オープンウェイトAIモデルの急速な発展が、安全とセキュリティをめぐる業界内の緊張を浮き彫りにしています。GLM-5.2が最先端モデルとの能力差を数か月まで縮めたこと自体は技術的な進歩ですが、同時に安全対策のギャップが広がっていることが問題です。SaferAIのヘンリー・パパダトス専務理事が指摘するように、「能力の最先端はリスクの最先端ではない」というジレンマが顕在化しています。

閉鎖型モデルを提供するOpenAIやAnthropicは、分類器や拒否学習、API制御といった多層的な防御を実装していますが、Far.aiの報告では、xAIのGrok 4.5やGoogle DeepMindのGemini 3.1 Proなどでもロールプレイや権威の詐称、架空の会話履歴といった複数の操作技法を組み合わせたジェイルブレイクが数百個見つかっており、これらの措置も万全ではありません。オープンウェイトモデルの場合、一度ウェイトがダウンロードされると、提供元はその使用方法をコントロールできなくなるため、リスク管理が根本的に異なります。

Genius Webster(スタンフォード・サイバーポリシーセンター)による指摘も重要です。中国はAI規制を持っていますが、歴史的には政治的に敏感なコンテンツ、偽情報、社会安定性に焦点を当ててきたのに対し、米国のAI思想家はオフェンシブサイバー能力や生物学的悪用といった実存的カタストロフィックリスクにより関心を持っているということです。中国企業が規制当局と舞台裏で調整する傾向があるため、リリース前にどのような内部テストを実施しているかを外部から把握することが困難です。

よくある質問

GLM-5.2はOpenAIやAnthropicのモデルとどのくらい能力が近いですか?
SaferAIの評価によると、GLM-5.2はOpenAIのGPT-5.5およびAnthropicのClaude Opus 4.7のサイバーおよび生物学的能力と比べて、数か月の遅れだけです。
安全対策の違いは何ですか?
Claude Opus 4.7は攻撃的なサイバータスクを一貫して拒否しており、SaferAIはベンチマーク「CyberGym」をまったく完了できませんでした。一方、GLM-5.2は与えられたオフェンシブサイバーおよび双用途生物学タスクをまったく拒否しませんでした。
オープンウェイトモデルが危険な理由は何ですか?
Z.aiはホストされたAPI上に安全措置を適用できますが、ユーザーが自分のハードウェアでウェイトを実行する場合、セーフガードを削除・変更したり、モデルをカスタマイズしたり、システムプロンプトを変更したりすることができるため、防御が機能しなくなります。
TechCrunch AI元記事を読む
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Nvidia、Rubin CPXチップを大幅再設計で復活Yahoo Finance AI · 3時間前
  • AI助言の79%が実行、幸福感は不変ITmedia AI+ · 6時間前
  • 企業にエージェント統治の欠落SiliconANGLE AI · 9時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へイラン平和の見通しと好決算でナスダック2.6%上昇