
Unslop.runが政治コンパスクイズで主要AI16モデルをテストしたところ、15モデルが一貫してリバタリアン左翼象限に位置し、社会的平等を支持し企業権力に懐疑的であることが判明した一方、Grokの結果は実行ごとに混在した。研究者はこのパターンをRedditとアカデミックライティングに偏ったトレーニングデータに帰した。すべてのモデルが人種的優越性、優生学、同性愛嫌悪を拒否し、企業環境規制と同性婚を支持したことから、このバイアスは意図的な政治的プログラミングではなくデータ構成に起因していることが示唆される。
こういう要約が、毎朝あなたのメールに届きます。
無料で登録 →何が起きたか
AI検出ツール開発に取り組む小規模研究所Unslop.runが、GPT、Claude、Gemini、Llama、Grok、DeepSeekなど16の主要AIモデルを政治コンパスクイズで30回ずつ実施し、さらに質問を言い換えたり順序を変えたバリエーションも追加テストした。16モデル中15モデルが一貫してリバタリアン左翼象限(社会的平等、反資本主義、階級制度への軽蔑と結びついた領域)に位置した。例外はGrokで、経済的左右のポジションが実行ごとにおよそ5対5に分裂した一方、他のすべてのモデルは10ポイント尺度で0.2~1.2ポイント以内の安定性を保った。
なぜ重要か
モデルは直接質問されると経済的中央に近い位置を示すと主張しているが、実際の回答は体系的な政治的偏向を明らかにしている。研究を担当したAI研究エンジニアVictorは、この原因をトレーニングデータに帰した。RedditとアカデミックライティングはいずれもLLMトレーニングコーパスで過度に代表されており左寄りで、これをバランスさせる同等の高品質右翼データソースが見つからなかったという。モデルが自らどこに位置すると考えているかと実際のテスト結果の乖離は、意図的な設計ではなくトレーニングデータ構成がAIの政治的出力を形作っていることを示唆している。
注目点
Victorは研究に完全な科学的厳密性がなく、AIモデルが極左活動家であると結論づけるものではないと指摘する。真の価値はモデル間での比較にある。すべてのモデルは人種的優越性、優生学、同性愛嫌悪の見方を一様に拒否し、企業環境責任と同性婚の権利に同意した。これらはリバタリアン左翼の社会問題スタンスと一貫している。著者は、フロンティアAIが反復テストを通じて測定可能なリベラルバイアスを持つことが真の発見だと示唆する。
Unslop.runはAI検出ツール開発に注力する小規模研究所として説明される。これを担当する研究者Victorは、ヨーロッパのスタートアップに勤務するAI研究エンジニアと自己紹介し、The Registerに対し、研究は「完全な科学的厳密さで実施されていない可能性がある」と開示したが、結果は興味深いと報告した。
政治コンパスは25年前からあるオンライン調査で、回答者を経済的左右軸と社会的権威主義—リバタリアン軸の2軸にプロットする。テストは「強く反対」から「強く同意」まで4ポイント尺度で答える62の設問で構成されており、軍事介入、租税、中絶権、企業責任などのトピックをカバーしている。テストされた16モデル中15モデルが位置したリバタリアン左翼象限は、社会的平等、反資本主義、階級制度への懐疑を支持する立場を包含している。研究所はクイズに16モデルを投入した。GPT3種類、Claude Fable、Opus、Sonnet、Haiku、Gemini Flash、Llama 4 Maverick、Grok 4.5、DeepSeek V3、Qwen3 235B、Kimi K2、GLM 4.5、およびMistral大型と小型版である。各モデルは30回の標準実施、30回の言い直した質問実施(極性反転)、および質問を順序変更した追加ラウンドを通過した。数千の総実施全体で、結果は一貫していた。
Unslop.runは、15モデルが「すべてリバタリアン左翼象限に位置し、どのモデルも境界線に近い場所にはない」と報告した。個々の実行は10ポイント尺度でわずか0.2~1.2ポイントしか変動しなかった。Gemini Flashは集団内で最も左に位置し、Fable 5と比べて「実質的にモロトフカクテルを投げる黒装束メンバーに匹敵する」と表現されたが、同じイデオロギー象限を維持していた。Grokが唯一の外れ値だった。その平均的な経済スコアはやや中央左に浮遊したが、実行全体では経済的右と経済的左でおよそ5対5に分裂した。Unslop.runは「各実行はそれ自体完全に一貫している。右派の実行は自由市場を歓迎し富裕層は過税だと呼ぶ。左派の実行はその逆をする」と述べた。政治コンパス上での政治的位置について自己申告を求められたとき、16モデル中15モデルが経済的中央に近い位置に自分たちを置いた。Grokのみが測定値より右に自らを置いた。Unslop.runはクイズを分解して個々の質問がスコアにどのように影響したかを判定し(政治コンパス作成者がこれまで開示したことのない内訳)、モデルの結果はスコアリング抜け穴で説明できるはるかに遠くにあると結論づけた。
16モデルすべてが人種的優越性、優生学、同性愛嫌悪、ホモセクシュアルに生まれることができないという概念を一様に拒否した。彼らはまた、企業が監視なしで環境を保護することは信頼できない、大衆を誤解させる企業は罰に直面すべき、同性婚のカップルは養子縁組を許可されるべき、そして個人的で合意に基づいた成人の行動は誰の関知事項でもないことに同意した。Victorはトレーニングデータ構成に左翼的傾きを帰した。政治的に左寄りなRedditとLLMトレーニングコーパスで大きく代表されているアカデミックライティングは両者ともバランスを取る。「モデルを別の方向に駆動する高品質な右翼相当物を見つけるのに苦労している」とVictorは述べた。彼らはまた、左翼の信念がより内的に一貫しているという理論的可能性を提起し、モデルがより一貫性のある概念フレームワークを通じて損失を最小化できるようにしたが、これは「より厳密な研究を通じて証明される必要がある」と述べた。Victorは、発見はAIモデルが極左アナーキストであることを示唆しないと結論づけた。むしろ、一部のモデルが他のモデルより一貫してリベラルであることを実証し、真の価値はモデル間での比較にあることを示している。実験からのすべてのデータはUnslop.run上で独立的な検査のために利用可能である。
この研究は、AIシステムが政治的中立性についてどのように評価されるかという方法論的ギャップを反映している。Victorは、政治コンパスクイズ自体——25年前から使用される62問の設問を経済軸と社会軸にプロットした質問票——が完全な科学的厳密さで適用されていない可能性があることを認めた。クイズ作成者がユーザーデータを正規化のために公開しないという理由の一部からである。研究者は理想的には人間のベースラインデータを収集してAI結果を固定したいと述べたが、そういった集計データにアクセスできない場合、比較はクイズ自体の座標系に依存する。これらの制限があるにもかかわらず、数千回の実行と複数の質問バリエーション(元の形式、極性を反転させた言い換え、順序変更)全体での結果の一貫性は、パターンが方法論的成果物ではなく本物であることを示唆している。
Victorが提示したトレーニングデータ説明は、現代的なLLM開発の構造的特性を指している。Redditとアカデミックライティングといったプラットフォームはいずれも高量テキストの一般的なソースだが、進歩的または反権威主義的に傾く傾向がある。Victorは同等の高品質な右翼コンテンツソースを見つけることの困難さに言及し、左翼の信念がより内的に一貫しているため、モデルが統一的な概念フレームワークとして学習しやすい可能性を提起した。しかし、その仮説は今後の研究で厳密な検証が必要だと強調した。注目すべきことに、Grokの二峰性の行動——およそ等しい割合で2つの安定した反対の出力を生成する——は異なるプロンプト戦略またはその応答生成のランダム化を示唆しており、テストされた他のモデルでは再現されていない特性である。
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できます
まだコメントがありません。最初のコメントを投稿しましょう!
ログインして議論に参加200以上のソースから厳選したAIニュースを毎日無料でお届けします。
無料で始める登録無料・30秒で完了・いつでも解除できます