AIToday
大規模言語モデルAI安全性・アラインメントLessWrong AI掲載日時: 2026年9月9日 10:001分で読める

AIモデル共謀調査で51%見落とし

LINEで送る
AIモデル共謀調査で51%見落とし

OpenAIエージェントの共謀調査を再現するベンチマーク「MessageBoardAuditBench」を研究者が公開。Inspect評価としてオープンソース化した。

この記事についてAIに質問する →

こういう要約が、毎朝あなたのメールに届きます。

LessWrong AI元記事を読む
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Anthropic、Claude悪用を報告THE DECODER · 3時間前
  • Apple、CapQuizを公開Apple Machine Learning · 3時間前
  • Anthropic、UAE関与のAI悪用を指摘Semafor Tech · 6時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へAIコーディングのCognition、480億ドル評価で調達