AIToday
AI安全性・アラインメントAI規制・政策AIビジネス・産業Latent Space掲載日時: 2026年9月15日 16:00

AEF-1基準公表、Dario氏が常駐評価者を約束

LINEで送る
AEF-1基準公表、Dario氏が常駐評価者を約束

3つのポイント

  1. 何が起きたか

    Anthropic CEOのDario Amodei氏が異例の個人ブログを公開し、第三者評価者を自社オフィスに常駐させると一方的に約束。机や入館証、社用ノートPCも提供する。

  2. なぜ重要か

    AI Evaluator Forumも独立評価の基準案AEF-1を公表。アクセス、利益相反、資金、忌避、透明性を網羅し、安全を原則から検証可能なプロセスへ移す動きだ。

  3. 注目点

    大手ラボが採用した評価者が真に独立し得るかが試金石。Kevin Bass氏はAnthropicと安全エコシステムの一部の金銭的関係を主張するスレッドで最大の反響を得た。

誰に効くかこれはフロンティアラボのAI安全・評価チームに影響する。彼らは社内リスクワークフローへの社員同様のアクセスを得ることになる。また、安全公約の検証に採用されるMETRなどの第三者監査機関にも及ぶ。

この記事についてAIに質問する →

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

ペース配分論争は、7月に「Pacing the Frontier」で初めて登場して以来、今週再燃した。原案の筆頭執筆者であるDario Amodei氏は、ペース配分をどう見るかを綴った異例の個人ブログを書き、2025年12月に発足したAI Evaluator Forumは、第三者評価者に何を求めるかを示すAEF-1を折しも同時期に公表した。フォーラムのメンバーは、おそらく大手ラボが自主規制のために採用する主要な第三者監査機関だろう。

提案は常駐評価者、民主的調整、グローバル調整の3部構成だ。机、バッジ、ノートPC、そして社内リスク評価チームとほぼ同等のワークスペースやツールへのアクセスを約束するAmodei氏の公約は、標準的な国内の自主規制の手引きより踏み込んでいる。AEF-1の基準はアクセス、利益相反、資金関係、忌避、透明性を網羅し、批評家が指摘してきた論点と重なる。

発表の裏には激しい意見の分裂がある。Bilal Chughtai氏はGoogle DeepMindを去り、ペース配分と透明性の向上を訴えた。Dan Selsam氏は、モデルが評価下では整合的に見えても不整合を隠している可能性があると主張した。一方、Shashank/Sayash Kapoor氏とLennart Heim氏は逸脱エージェント事例をセキュリティとガバナンスの問題と位置づけ、Aidan Gomez氏は一部のシリコンバレー企業がAIのゲートキーパーになることに反対した。試金石は、常駐評価者が実際に真の独立を保てるか、そしてAnthropicと安全エコシステムの一部の金銭的関係を巡るKevin Bass氏の主張が持ちこたえるかだろう。

よくある質問
Anthropicは具体的に何を約束するのか?
Dario Amodei氏の投稿によれば、Anthropicは今、第三者評価者を自社オフィスに常駐させ、机、入館証、社用ノートPC、そして社内リスク評価チームとほぼ同等のワークスペース権限を与えると一方的に約束している。
AEF-1とは何か?
AEF-1はAI Evaluator Forumが公表した独立した第三者によるAI評価の基準案で、アクセス、利益相反、資金関係、忌避、透明性を網羅する。
Amodei氏のペース配分枠組みの3段階とは?
投稿は常駐評価者、民主主義国のフロンティアAI企業間の民主的調整、権威主義政府との可能な限りのグローバル調整の3つを示している。
Latent Space元記事を読む
LINEで送る

「AI安全性・アラインメント」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Amodei氏のAI減速論、チップ需要に影響せずDIGITIMES Asia · 3時間前
  • Gartner予測:AIエージェントに認証情報を共有する組織の90%が2028年までに問題に直面ITmedia AI+ · 3時間前
  • Fable 5.1ハッキング、修正で0/30LessWrong AI · 3時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へGPT-6 Astra、CoTなしの確率的推論を示す