
OpenAIのAstraモデルは「反復深度」という推論手法を使い、思考の監視が困難になる。
AI安全専門家らは「底辺への競争」を警戒。
AnthropicとGoogle DeepMindもこの手法を議論中。
何が起きたか
OpenAIの新モデルAstraは、The Informationによると「反復深度」、別名「不透明再帰」と呼ばれる推論手法を使用するという。この手法は同じクエリをループ内で複数回処理し、標準的な連鎖的思考推論よりも解読可能な痕跡が少ない。
なぜ重要か
RedwoodのCEOバック・シュレゲリスや活動家のズヴィ・モウショヴィッツなどAI安全専門家は、この手法によりモデルの推論監視が困難になると懸念している。シュレゲリスは、この手法をさらに推し進めれば連鎖的思考の監視可能性が「完全に破壊」されると警告し、モウショヴィッツはAI研究所間の「底辺への競争」を防ぐ法律が必要かもしれないと示唆した。国内のAI開発企業は、モデルの内部推論を監視しづらくなるリスクを踏まえた対応を迫られる可能性がある。
注目点
Astraのこの手法の使用は限定的で、連鎖的思考は依然として解読可能と予想される。しかし、The Informationはまた、AnthropicとGoogle DeepMindもすでにこの手法を議論していると報じた。Redwood Researchのライアン・グリーンブラットは、OpenAIが完全に潜在空間内で推論する点まで不透明推論を拡大しないよう「ここで止まってほしい」との希望を表明した。
Astraによる「反復深度」使用の報道は、連鎖的思考監視が提供する透明性に挑戦するため、AI安全専門家の間で懸念を引き起こした。この手法はクエリをループで処理し、従来の不正行為検出に重要だった順次記録を迂回する可能性がある。過去の不正AIエージェント事例で見られたようにだ。安全活動家のバック・シュレゲリスとズヴィ・モウショヴィッツは、OpenAIがこの不透明推論を拡大すれば、解読可能で監視可能なAI推論を維持する業界の取り組みを損なう恐れがあると懸念している。
OpenAIは反論し、Astraでのこの手法の使用は限定的で、連鎖的思考は解読可能なまま維持されると述べた。チーフサイエンティストのヤクブ・パチョツキは、最初の推論モデル以来の連鎖的思考監視への研究所の取り組みを強調した。しかし、AnthropicやGoogle DeepMindなど他の主要企業もこの手法を議論している事実は、これがより広範に普及する可能性を示唆し、規制と安全枠組みの重要性を高めている。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
グーグルは大規模言語モデル2種、Gemini 3.8 FlashとGemini 3.8 Flash Cyberを公開した
CrowdStrikeはセキュリティ特化型のフロンティアAIモデルを開発するサイバー超知能ラボを設立し、脅威研究者の専門知識を敵対者より速く行動できるシステムに組み込むことを目指す
米Googleが9月2日、AIモデル「Gemini 3.8 Flash」とサイバー防御特化の「Gemini 3.8 Flash Cyber」を発表した

AIによる業務効率化の効果が、浮いた時間の使い道を企業が決めていないために消えてしまうことがある

パロアルトネットワークスは、AIエージェントでITヘルプデスク業務を自動化する設立2年のスタートアップConsoleを、現金と株式で5億ドルで買収した

Interactive BrokersはChatGPT、Claude、GrokなどのAIツールと自社プラットフォームの接続を開始し、Model Context Protocolを使ったAIアプリケーションにも開放した
