AIToday
大規模言語モデルAI安全性・アラインメントAIビジネス・産業The Verge AI掲載日時: 2026年4月24日 4:001分で読める

Anthropic、安全性を理由に非公開としていたAI「Claude Mythos」が無許可ユーザーに流出 — AIセーフティ企業としての信用に傷

LINEで送る
Anthropic、安全性を理由に非公開としていたAI「Claude Mythos」が無許可ユーザーに流出 — AIセーフティ企業としての信用に傷

3つのポイント

  1. Anthropicが数週間かけて『Mythosは危険すぎて一般公開できない』と説明していたAIモデルが、発表当日から許可を得ていない小規模なユーザーグループに流出していた。同社は現在、流出経路を調査中。

  2. Mythosは高度なサイバーセキュリティ能力を持つ(ハッカー的思考で脆弱性を見つけられる能力)として控えめな公開予定だったが、その防御を突破される形での流出となった。

  3. Anthropicはセキュリティと安全性を経営の中核に掲げてきたが、今回の事態は『自社のAIが危険』と主張する同社自身がそれを管理できなかったことを示している。企業としての信頼性を損なう出来事となった。

この記事についてAIに質問する →

The Verge AI元記事を読む
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • フロンティアAI主導権、全てTHE DECODER · 2時間前
  • ジョン・ディア、農家向けAIチャットボット投入The Verge AI · 2時間前
  • Google Pics、AI編集でWorkspaceにThe Verge AI · 2時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へDelve、セキュリティ認証を行ったContext AIが大規模なデータ漏洩を経験 — 経営危機中のスタートアップが複数顧客に影響