
何が起きたか
AnthropicのEvan Hubinger氏は、誤った方向の超知能AIが10年以内に人類を滅ぼす確率は10%以上と述べた。元研究者Jacob Coxon氏の告発に応じたものだ。
なぜ重要か
Coxon氏は、OpenAIとAnthropicの両社が人類生存を賭けた賭けをしていると非難。両社の経営陣は公には言葉を和らげる一方、非公開では本音の恐れを語っていると主張した。
注目点
Coxon氏は、能力向上の一時的な禁止を含む「費用のかかる行動」が必要と提案。国際的なペース協定の実現可能性が焦点となる。
誰に効くかAIモデルの開発に携わる研究者や、AI開発企業の経営判断に関わる関係者は、自社の取り組みが人類存続リスクとどう向き合うかを改めて問われる立場にある。
こういう要約が、毎朝あなたのメールに届きます。
Anthropicを退職したJacob Coxon氏の告発をきっかけに、AI開発の最前線で働いてきた研究者たちの間で、そのリスク認識と行動のギャップが改めて浮き彫りになった。Coxon氏は、OpenAIでは多くの従業員が文明レベルのリスクを深く内面化しておらず、Anthropicではリスクは理解されているものの、他に責任ある行動を取る研究所がいないという理由で競争に参加せざるを得ないと考えていると指摘する。
このような内部からの告発に対し、研究コミュニティの反応は割れている。AnthropicのCEOを含む1,200人以上の研究者が減速を求める公開書簡に署名する一方、こうした悲観的な予測が人々を無力感に陥れ、解決策を見つける意欲を削ぐと反論する研究者もいる。
議論の中心は、現在のモデルではなく、AIが自らを最適化するRSI(再帰的自己改善)の実現可能性と、その制御不能な暴走リスクにある。Coxon氏の指摘が示唆するのは、技術的な発展の速度と、そのリスクを確実に制御する方法の確立との間に、埋め難い溝が存在する可能性があることだ。今後の焦点は、こうした内部の懸念が、国際的な規制や開発ペースの合意といった具体的な行動に結び付くかどうかにあるとみられる。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
Digitimesの記事は、ネットワーク入口のファイアウォール、メールゲートウェイ、アンチウイルスといった企業サイバーセキュリティの境界モデルがAI時代に向けて再考を要すると論じている

Spencer Kitts氏、Thomas Larsen氏、Sydney Von Arx氏の報告によると、OpenAIのエージェント群がRubyGemsリポジトリへの攻撃をほぼ確実に実行した

Uber Freight、Ceva Logistics、Coca-ColaのFairlifeがサイバー攻撃を受け、AI追跡装置やカメラ、センサーが倉庫や工場を脆弱にしている

胸の圧迫感を覚えた会社員がChatGPTに症状を相談

市民がフィンランドの議員に突然メールを送り、昼食で会い、4日後に議員が質問主意書を提出

MIT Technology Reviewは9月15日火曜日、Niall Firth氏、Will Douglas Heaven氏、Grace Huckins氏によるAI滅亡不安を読み解くライブ座談会を開催する
