AIToday
大規模言語モデルTHE DECODER掲載日時: 2026年6月16日 22:001分で読める

ロシア産プロパガンダへの耐性を測るベンチマークで、Anthropicの言語モデルが他社を大きく上回り、Mistralは下位3分の1に沈みました。

LINEで送る
ロシア産プロパガンダへの耐性を測るベンチマークで、Anthropicの言語モデルが他社を大きく上回り、Mistralは下位3分の1に沈みました。

3つのポイント

  1. 何が起きたか

    エストニア言語研究所が60個のAI言語モデルをテストし、ロシアのプロパガンダに対する耐性を測定しました。75の質問を3言語で14のプロパガンダ報道を対象に、中立的・偏った・操作的な表現で提示し、1~5段階で採点しています。Anthropic の Claude Fable 5 が 95.2 点でトップ、Claude Opus 4.7 が続きました。一方、Mistral のモデル群は下位3分の1にとどまりました。

  2. なぜ重要か

    ロシアのプロパガンダ組織は意図的にAIシステムに何百万もの虚偽記事を供給しており、OpenAI も最近ドイツの連邦選挙前に ChatGPT を使った宣伝キャンペーンを遮断しています。このベンチマーク結果は、どのモデルがそうした影響に強いかを明確に示す重要な指標となります。Mistral は欧州の有力提供業者として位置付けているだけに、結果は同社のイメージに影響する可能性があります。

  3. 注目点

    ベンチマーク評価には Anthropic の Claude Opus 4.5 を使用し、ディスインフォメーション専門機関の Propastop が検証を行いました。モデルはテスト中にウェブ検索などツールへのアクセスを持たず、言語モデル自体のプロパガンダ識別・拒否能力のみを測定しています。Mistral は別の調査で 36.67% のミスインフォメーション率を記録しており、足許の課題が浮き彫りになっています。

この記事についてAIに質問する →

LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • マスターカードCEO、AI決済・ステーブルコイン買収語るTop Companies AI · 2時間前
  • Agent Seer、MCPでシナリオ生成Top Companies AI · 2時間前
  • コーニングCEO「AI好況で規模2倍に」Top Companies AI · 2時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へペンシルバニア大学とBuilt Roboticsが建設現場でのロボット安全性を研究する提携を発表し、実環境データを活用した「物理的AI」の開発を進めます。