AIToday
大規模言語モデルAI安全性・アラインメントAIビジネス・産業arXiv cs.CL掲載日時: 2026年4月15日 13:001分で読める

大規模言語モデルが人間と同じ「特定の被害者効果」を示す:16の最先端AIモデルの51,955試験で実証

LINEで送る
大規模言語モデルが人間と同じ「特定の被害者効果」を示す:16の最先端AIモデルの51,955試験で実証

3つのポイント

  1. Google、Anthropic、OpenAI、Meta、DeepSeekなど9つの組織による16の最先端LLMが、統計データより個別の被害者への物語的説明に対してより多くのリソースを配分する傾向を示した

  2. 識別可能な被害者効果(IVE)は道徳心理学と行動経済学における最も堅牢な知見の一つであり、AIシステムが人間の感情的な非合理性を継承していることが初めて系統的に実証された

  3. 人道支援のトリアージ、助成金評価、コンテンツモデレーションなどの重要な意思決定にLLMが使用される中、このバイアスが実務的な問題となる可能性を示唆している

この記事についてAIに質問する →

LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • ウィナンプ、AI音楽訴訟拡大 6社追加Yahoo Finance AI · 2時間前
  • LLMベンチマーク監査法 BenchMIRT公開Hugging Face Blog · 8時間前
  • グーグル、ハリウッドにAI契約持ちかけThe Verge AI · 8時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へTCGAの3,634枚の病理画像からAIが腫瘍微小環境を分析する大規模オープンデータセット「OpenTME」が公開