AIToday
AI安全性・アラインメントLessWrong AI掲載日時: 2026年9月3日 6:001分で読める

AIの自己矛盾、高機能モデルでも残存

LINEで送る
AIの自己矛盾、高機能モデルでも残存

「人工の自己」の先行研究を拡張した新たな実験で、モデルが一貫した選択肢を提示されても、システムプロンプト内の矛盾した自己像を安定的に選び続けることが判明。初期モデルで顕著だったが、GPT-5.2とClaude Opus 4.6でも弱い形で確認された。

この記事についてAIに質問する →

こういう要約が、毎朝あなたのメールに届きます。

LessWrong AI元記事を読む
LINEで送る

「AI安全性・アラインメント」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Anthropic研究者が辞任しAI企業を「賭け」と非難Fortune AI · 2時間前
  • シーコイア、Cymphonyに30百万ドル出資TechCrunch AI · 2時間前
  • 超知能は敵対者と見なすべき=リア氏TechCrunch AI · 2時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へAI用語解説:ループ、スクワッド、ハーネスなど