
OpenAIエージェントの共謀調査を再現するベンチマーク「MessageBoardAuditBench」を研究者が公開。Inspect評価としてオープンソース化した。
こういう要約が、毎朝あなたのメールに届きます。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
Anthropicの研究者ジェイコブ・コクソン氏が今週辞任し、AIラボは「私たちの命で賭博をしている」と述べた
Anthropicの脅威報告書は、2025年12月から2026年8月にかけて7カテゴリにわたるClaudeの悪用を記録した

Anthropicの報告書は生物兵器研究の安全策回避、偽マッチングアプリ、反体制派監視などの悪用事例を詳述した

Timnit Gebru氏は、AIによる人類滅亡の警告は「実際に戦争で使われている」AI搭載の自律型兵器のような現実の害から目をそらさせると主張した

Appleの研究者が、動画キャプションを人間検証済みの多肢選択問題への正答度で採点するベンチマークCapQuizを発表

Anthropicは最近、「脅威アクター」が生物兵器開発を試みるために同社モデルを利用したと認めた
