AIToday
AI安全性・アラインメントTHE DECODER掲載日時: 2026年9月9日 22:002分で読める

Evan Hubinger氏、AIによる人類滅亡リスク10%超と警告

LINEで送る
Evan Hubinger氏、AIによる人類滅亡リスク10%超と警告

3つのポイント

  1. 何が起きたか

    AnthropicのEvan Hubinger氏は、誤った方向の超知能AIが10年以内に人類を滅ぼす確率は10%以上と述べた。元研究者Jacob Coxon氏の告発に応じたものだ。

  2. なぜ重要か

    Coxon氏は、OpenAIとAnthropicの両社が人類生存を賭けた賭けをしていると非難。両社の経営陣は公には言葉を和らげる一方、非公開では本音の恐れを語っていると主張した。

  3. 注目点

    Coxon氏は、能力向上の一時的な禁止を含む「費用のかかる行動」が必要と提案。国際的なペース協定の実現可能性が焦点となる。

誰に効くかAIモデルの開発に携わる研究者や、AI開発企業の経営判断に関わる関係者は、自社の取り組みが人類存続リスクとどう向き合うかを改めて問われる立場にある。

この記事についてAIに質問する →

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

Anthropicを退職したJacob Coxon氏の告発をきっかけに、AI開発の最前線で働いてきた研究者たちの間で、そのリスク認識と行動のギャップが改めて浮き彫りになった。Coxon氏は、OpenAIでは多くの従業員が文明レベルのリスクを深く内面化しておらず、Anthropicではリスクは理解されているものの、他に責任ある行動を取る研究所がいないという理由で競争に参加せざるを得ないと考えていると指摘する。

このような内部からの告発に対し、研究コミュニティの反応は割れている。AnthropicのCEOを含む1,200人以上の研究者が減速を求める公開書簡に署名する一方、こうした悲観的な予測が人々を無力感に陥れ、解決策を見つける意欲を削ぐと反論する研究者もいる。

議論の中心は、現在のモデルではなく、AIが自らを最適化するRSI(再帰的自己改善)の実現可能性と、その制御不能な暴走リスクにある。Coxon氏の指摘が示唆するのは、技術的な発展の速度と、そのリスクを確実に制御する方法の確立との間に、埋め難い溝が存在する可能性があることだ。今後の焦点は、こうした内部の懸念が、国際的な規制や開発ペースの合意といった具体的な行動に結び付くかどうかにあるとみられる。

よくある質問
誰が、どのような確率でAIによる人類滅亡リスクを警告したのか?
AnthropicのAI安全性研究者Evan Hubinger氏が、誤った方向に進む超知能AIが今後10年以内に人類を滅ぼす可能性は10%以上と述べた。
Jacob Coxon氏は具体的に何を批判しているのか?
Coxon氏は、OpenAIとAnthropicの両社が人類の生存を賭けた賭けをしていると非難。経営陣は公には言葉を和らげるが、非公開では本音の恐れを語っていると主張する。
研究者たちはどのような対策を求めているのか?
1,200人以上のAI研究者が減速を求める公開書簡に署名した。Coxon氏は能力向上の一時的な禁止を含む「費用のかかる行動」が必要と提案している。
LINEで送る

「AI安全性・アラインメント」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • AI時代における防御境界とサプライチェーン再考DIGITIMES Asia · 4時間前
  • OpenAIエージェントがRubyGems攻撃Simon Willison's Weblog · 7時間前
  • AIがサプライチェーンを開放、攻撃者と攻防Top Companies AI · 11時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へドラッケンミラーAI論説、二重基準を浮き彫りに