
LLMベースのツール拡張エージェントが実行層でどのように振る舞うかを測定する新しいアプローチを導入
A-R空間(行動率と拒否信号の2次元空間)を使用し、言語シグナルと実行可能な動作の構造的関係を分析
4つの規範的制度(制御、グレーゾーン、ジレンマ、悪意)と3つの自律性設定(直接実行、計画、省察)でモデルを評価
集約的な安全スコアではなく、文脈的枠組みとスキャフォルディングの深さに応じて実行と拒否がどのように変わるかを特性化
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
SemaforとRiddance AIは、実在の俳優とAI生成スクリプトを使い、民主党政治家に関する誇張や虚偽の主張を広める約12のYouTubeチャンネルを発見

最近のICRAパネルで、ロボット工学の研究者らが論文数の急増への対応を議論した

Anthropicは新たな旗艦モデルとしてClaude Fable 5.1とClaude Mythos 5.1を公開した

GoogleはGemini 3.7 Flash、3.6 Flash、3.5 Flash-Liteにエージェント型動画分析を追加した

ウィナンプ・グループ傘下のJamendo SAは、NVIDIAに対する米連邦訴訟を修正し、正式な送達が完了した

Anthropicの年換算売上高(年間ベースの売上レート)は7月に650億ドルを超え、前年の7倍に達した
