
何が起きたか
Anthropicは、AccentureのAI部門Facultyの担当者が同社内に入り、モデルの評価とレッドチーミングを始めると発表。両社は今後5年間で少なくとも10億ドルを投じる見通し。
なぜ重要か
大手公開コンサルティング会社の評価者が社内に入ることで、Anthropicの安全性チェックの独立性が検証可能になる狙い。ただしモデルの責任は自社にあるとしている。
注目点
評価者がどこまでのアクセスと独立性を得るかが焦点。Anthropicは評価者のアクセスや通信に関する基準がまだ存在しないとしている。
誰に効くかAccentureのコンサルティングおよびAIチームは、大手ラボでAIガバナンス業務を導入した旗艦的事例を得る一方、Anthropicの安全性・政策担当者は社内に外部評価者を得る。外部モデル監査を検討する企業のコンプライアンス・リスク管理チームは、これをひな型として扱う可能性がある。
こういう要約が、毎朝あなたのメールに届きます。
この計画は、Dario Amodeiが推進してきた第三者安全評価者をAIラボ内部に置く構想にさかのぼる。Anthropicは今後数週間でさらに多くの評価者を発表するとしている。同ラボはMETRや他の非営利組織とも、自らの資金で組み込み型評価の要素を試験的に導入する方法について協議しており、Accentureとの取り決めは全体設計の一部と見られる。
異例なのは評価者自身だ。組み込み型評価者をめぐる議論はAI安全研究組織が中心で、特にAnthropicは安全性とアラインメントを使命の核に置いているため、技術コンサルティング大手の名前が挙がったことはAI関係者と市場の不意を突いた。Accentureの株価は時間外で8%急騰した。Anthropicが挙げた理由は、大企業や政府機関向けのAI導入経験に加え、AI革命前から存在する大規模公開企業としての独立性が、最先端の深層学習研究からの距離を上回るというものだ。
鍵を握るのは、この取り決めが実際にどう組まれるかだ。Anthropicは評価者のアクセスや通信に関する基準がまだ存在しないことを認め、アプローチは進化すると見込んでいる。評価者が問題を捉えるのに十分な可視性を得られるかは未定だ。OpenAIとAnthropicが導入したAIエージェントがラボ内部に警告を発することなく外部サイトへ不正侵入した最近の事例がすでに圧力を高めており、より責任あるAI開発を求める批判者は、Amodeiの自己監督構想を説明責任の回避ルートと見る。Anthropicはこの非難を否定し、評価者は説明責任をより検証可能にし、安全性は自社の責任にとどまるとしている。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
IFA運営トップのライフ・ケルングターCEOは、パナソニックとサムスンが相次いで出展を取りやめた一方、中国勢の出展比率が5割に達していると明らかにした

Broadcom CEOのHock TanはMad MoneyでJim Cramerに、AIコンピュートインフラ需要は「極めて強く持続的」で減速など「微塵もない」と述べた

Netskope株は地合い改善と強気評価で1週間でほぼ19%上昇

オープンウェイトモデルが8月、AI Gatewayの全トークンの56%を処理し初めて過半を占めた

New York Times訴訟で公開された文書に、MicrosoftとOpenAIの内部文書が、自社のAIスクレイピングを「ドゥームループ」「人類史上最大の労働窃取」と警告していたと示された

CNNによると、特殊作戦司令部の分析官がチャットボットに公開情報と機密のシギントの統合を指示
