AIToday
AI安全性・アラインメントTHE DECODER掲載日時: 2026年9月11日 4:002分で読める

元Deepmind広報、人類絶滅リスクの言及禁じられていたと証言

LINEで送る
元Deepmind広報、人類絶滅リスクの言及禁じられていたと証言

3つのポイント

  1. 何が起きたか

    2018年から2022年までDeepmindの広報・政策チームに在籍したVishal Maini氏によると、スタッフは人類絶滅リスクについて公に議論できず、それを誇張だと表現するよう指導されていた。

  2. なぜ重要か

    数カ月にわたる反発を受け、Deepmindは規則を緩和し、前向きな枠組みの安全性コンテンツを許可した。絶滅リスクを親しみやすい言葉で包んだブログ記事も含まれる。

  3. 注目点

    Maini氏は、証拠を無視しにくくなった今、内部の知識と対外的なメッセージングの隔たりは縮まっていると述べる。Deepmindの研究者も声を上げる一人だ。

誰に効くかこれは、安全性リスクの伝え方をめぐって圧力に直面しかねないフロンティアラボのAI広報・政策スタッフ、そして未保護のモデルについて今公に声を上げている研究者たちに影響を及ぼす。

この記事についてAIに質問する →

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

Maini氏の証言は2018年から2022年を対象としており、この期間、同氏によればDeepmindの対外的なメッセージングでは人類絶滅リスクへの言及が一切禁止されていた。研究者たちはそうしたリスクを誇張として退け、「『ターミネーター』のような映画」と比較し、ヘルスケアや気候などの前向きな応用へ話題を転換するよう指導されていた。Maini氏によれば、内部的にはチームはAIアラインメント問題が未解決であること、そしてその問題に取り組む人があまりにも少ないことを知っていた。

その規則は維持されなかった。数カ月にわたる反発の後、Deepmindは規則を緩和し、前向きな枠組みの安全性コンテンツを許可した。絶滅リスクを親しみやすい言葉で包んだブログ記事も含まれる。Maini氏は、証拠を無視しにくくなった今、内部の知識と対外的なメッセージングの隔たりは縮まっていると述べる。

この証言は、危険な行為を可能にしかねない未保護のモデルや、人間の制御を超えかねない高度なシステムについて、ますます多くのAI安全性研究者が公に声を上げる中で出てきた。Deepmind自身の研究者もその一人だ。この変化が、そうした圧力がラボをより厳しいメッセージ管理へ戻すのを食い止め続けるかどうか、そして今公に声を上げている研究者たちがどう受け止められるかにかかっているように見える。

よくある質問
AIの人類絶滅リスクに関するDeepmindの規則はどのようなものだったか?
Vishal Maini氏によると、人類絶滅の可能性に関する外部コミュニケーションは、組織のどのレベルにおいても、誰によっても許可されていなかった。
Deepmindは方針を変えたのか?
はい。数カ月にわたる反発の後、Deepmindは規則を緩和し、前向きな枠組みの安全性コンテンツを許可した。絶滅リスクを親しみやすい言葉で包んだブログ記事も含まれる。
Deepmindのスタッフは内部的に何を知っていたのか?
Maini氏によると、チームはAIアラインメント問題が未解決であること、そしてその問題に取り組む人があまりにも少ないことを知っていた。
LINEで送る

「AI安全性・アラインメント」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • OpenAIエージェントがRubyGems攻撃Simon Willison's Weblog · 2時間前
  • AIがサプライチェーンを開放、攻撃者と攻防Top Companies AI · 6時間前
  • ChatGPT相談で受診した患者、医師に苦言Top Companies AI · 6時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へCoxon氏の退社投稿、1億回超え