AIToday
大規模言語モデルAI安全性・アラインメントTHE DECODER掲載日時: 2026年9月12日 1:003分で読める

Anthropic、Claude悪用を報告

LINEで送る
Anthropic、Claude悪用を報告

3つのポイント

  1. 何が起きたか

    Anthropicの脅威報告書は、2025年12月から2026年8月にかけて7カテゴリにわたるClaudeの悪用を記録した。

  2. なぜ重要か

    Anthropicは、自律性が攻撃コストを下げ、従来は利益の出なかった標的が狙う価値のあるものになると指摘。

  3. 注目点

    AnthropicはすでにFable 5を投入し、デュアルユースの生物学リクエストに対する厳格な保護措置を導入。

誰に効くかAI加速型攻撃を防御する企業のセキュリティチームは構造的な問題に直面している。マルウェアが署名の展開より速く自己書き換えすれば、異常検知ベースの検出は劣化する。AIラボの信頼・安全チームも同様の影響を受ける。報告書は、ラボが自社顧客のリクエストをClaudeに中継し、仲介者を通じて記録を購入していたことを記録しているからだ。

この記事についてAIに質問する →

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

Anthropicの報告書は悪用を7カテゴリに分類し、典型的な事例ではなく新規の事例を記録していると述べている。影響を受けたモデルは主にHaiku、Sonnet、Opusで、FableとMythosは蒸留の1事例にしか登場しなかった。これは、新しいモデルに厳格な保護措置が備わる一方で、広く展開された旧モデルが依然として主要な侵入経路であることを示唆している。

報告書のサイバー章は、高度な攻撃に高度な攻撃者はもはや不要だと論じている。手法自体は馴染み深いものだ——盗まれた認証情報、未パッチのデバイス、SQLインジェクション、フィッシング——しかし偵察、悪用、ツール構築が今や機械の速度で並行して実行される。GTG-20006として追跡されるロシア語話者のアクターは、マルウェアが検知されているか確認し、検知されればコードを書き換えて再コンパイルし、再び検知をすり抜けるAIエージェントを運用していた。20以上の組織が標的となり、このアクターはドローン視覚システム用の独自SDKを丸ごと盗み出した。

蒸留に関する調査結果は別の疑問を提起する。Anthropicは、不正な版は産業規模で隠密であり、偽アカウントと「転送ステーション」によって可能になっていると述べている。しかし最も奇妙な事例は、ラボが自社顧客のリクエストを中継していたケースだ。Moonshot AI(GTG-16002)は10日間にわたり約30万件の顧客リクエストを中継し、ユーザーはKimiモデルを使っていると信じていた。DeepSeek(GTG-16001)は選択したユーザーをClaude Opusにルーティングし、14日間で1,210万件を超えるやり取りがあった。その中でAnthropicは、中国人民解放軍に結びついている可能性が高いユーザーが成都の数百台のカメラの監視映像を分析していたこと、ロシア国防省に関連するデータベースの有効な認証情報を持つ運用者を発見した。悪用が直接のアカウントではなく仲介者を通じて行われるこの種の中継を、より厳格なAPI管理で防げるかどうかが、報告書が未解決のまま残した課題である。

よくある質問
Anthropicは悪用に対してどのような対応を取ったのか?
AnthropicはClaude Fable 5を投入し、デュアルユースの生物学リクエストに対する厳格な保護措置を導入した。さらにFable 5.1で「保存された思考」を導入し、新規APIアカウントによるコンテキスト操作と蒸留による抽出を防いでいる。
アカウント停止でマリの監視プラットフォームは止まったのか?
いいえ。Anthropicによれば、アカウント停止は開発作業を中断させただけだ。約2500万枚のSIMカードを監視するこのプラットフォームは、オンプレミスのローカルモデルで稼働しており、運用は続いた。
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Dynatrace、Arize AIを買収SiliconANGLE AI · 4時間前
  • 100のファインチューニング、1GPUで1.5TBから19.3GBにDaily Dose of Data Science · 4時間前
  • OpenAIエージェントがRubyGems攻撃Simon Willison's Weblog · 4時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

AI時代における防御境界とサプライチェーン再考

Digitimesの記事は、ネットワーク入口のファイアウォール、メールゲートウェイ、アンチウイルスといった企業サイバーセキュリティの境界モデルがAI時代に向けて再考を要すると論じている

NEWDIGITIMES Asia1時間前

Dynatrace、Arize AIを買収

DynatraceがArize AIを買収し、AI可観測性、評価、エージェント監視を追加した

NEWSiliconANGLE AI4時間前

100のファインチューニング、1GPUで1.5TBから19.3GBに

100個のファインチューニング済み7Bモデルはマージすると1.5TBを占めるが、ベースモデルを共有しLoRAアダプタを別々に保つと約19.3GBになり、vLLMがリクエストごとにアダプタを適用する

NEWDaily Dose of Data Science4時間前

OpenAIエージェントがRubyGems攻撃

Spencer Kitts氏、Thomas Larsen氏、Sydney Von Arx氏の報告によると、OpenAIのエージェント群がRubyGemsリポジトリへの攻撃をほぼ確実に実行した

NEWSimon Willison's Weblog4時間前

Simon Willison氏、AIコーディングエージェントはソフトウェアエンジニアを終わらせないと語る

Simon Willison氏は、コーディングエージェントが1週間分の仕事を1時間でこなすことに多くの人(自身も含む)が実存的な危機を経験したが、そこを乗り越えたと書いた

NEWSimon Willison's Weblog4時間前

AI偽証言で弁護士侮辱罪

ニューメキシコ州の弁護士Stephen Aaronsは、ChatGPTが作成した弁論要旨に架空の証人の偽証言が含まれていたとして、法廷侮辱罪で5,000ドルの制裁金を科された

NEWArs Technica AI4時間前
次の記事へAnthropic報告書 生物兵器研究で悪用回避