
何が起きたか
AnthropicのJacob Coxonが退社し、同社とOpenAIが自己改善型AIへ突き進み「我々の命を賭けている」と非難した。
なぜ重要か
Hubingerは今後10年でAIが全人類を殺す確率を10%超と推定し、超知能を制御する計画がまだないと認めた。安全性を売りにする企業の内部から、この懸念が補強された形だ。
注目点
Coxonは能力改善の一時禁止を含む協調的な減速を求めたが、誰が合意し、何を対象とし、どう執行するかは未定である。実効性のある枠組みを設計できるかが焦点となる。
誰に効くか最先端AIの安全性を評価する立場の研究者や、AIの導入判断を迫られる情報システム部門・政策担当者に影響が及ぶ。Anthropicの安全性主張を前提に調達や規制対応を進めてきた企業は、その根拠を再確認する必要が出てくるとみられる。
こういう要約が、毎朝あなたのメールに届きます。
Anthropicは以前からAI安全研究の不確実性を認めてきた。2023年3月の声明では、強力なシステムを確実に安全にすることが未解決だとし、競争が危険な展開を促す可能性や、自社の研究が失敗する可能性にも言及していた。Hubingerの率直な発言はこの立場の延長線上にある。
2026年8月14日公表のRisk Reportは、対象モデルが意図に反して大災害を起こすリスクを低いと判断した。根拠の一部は、モデルが監視を欺くほど強力でないという前提に置かれている。この前提は、より高能力な後継モデルでは再検証が必要になる。能力が監視回避に及べば、その前提に基づく安心は弱まるためだ。
Anthropicは、意味のある安全研究には最先端モデルへのアクセスが必要だと主張して開発を続ける。研究と開発を両立させるこの方針が機能するかは、Coxonが求めた協調的減速の実効性にかかっている。一時禁止に誰が合意し、何を対象とし、どう執行するかは未定であり、顧客と政策担当者は能力増強を正当化する証拠と減速の引き金を明確にするよう迫られるとみられる。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
Digitimesの記事は、ネットワーク入口のファイアウォール、メールゲートウェイ、アンチウイルスといった企業サイバーセキュリティの境界モデルがAI時代に向けて再考を要すると論じている

AIインフラ構築への注目は今や純粋な計算能力に集まり、支配力は高性能GPUや最速の建設で決まる

Barron'sが9月10日に報じたところによると、Kepler Computingがステルス状態から姿を現し、強誘電体材料と3D積層を用いたメモリ構造を発表した

DynatraceがArize AIを買収し、AI可観測性、評価、エージェント監視を追加した
ロイターが9月10日に報じたところによると、d-MatrixはNVLink Fusionを使い、次世代RaptorをNvidiaのデータセンターラックに直接接続する

100個のファインチューニング済み7Bモデルはマージすると1.5TBを占めるが、ベースモデルを共有しLoRAアダプタを別々に保つと約19.3GBになり、vLLMがリクエストごとにアダプタを適用する
