オプション
ニュース
AIチャットボットは政治投票分析において左寄りの偏向を示す

AIチャットボットは政治投票分析において左寄りの偏向を示す

2026年3月2日
150

画期的な実世界データを用いた研究において、ChatGPTをはじめとする大規模言語モデルが数千件の実際の議会投票を基に評価された。3カ国において、これらのモデルは一貫して左派および中道左派政党と一致する傾向を示した一方、保守政党との一致度は低かった。

 

オランダとノルウェーの新たな学術共同研究において、研究者らはChatGPTを含むChatGPTスタイルの大型言語モデル(LLM)に対し、3カ国で人間の立法者が過去に決定した数千件の実議案について投票を依頼した。

モデルの投票結果を実際の政党記録と比較し、標準的な政治的尺度でマッピングしたところ、明確なパターンが浮かび上がった:AIは一貫して進歩的・中道左派政党との一致度が高く、保守政党からは距離を置く傾向を示した。

論文は次のように述べている:

「我々の発見は、モデル全体にわたり一貫した中道左派・進歩的傾向と、右派保守政党への体系的な否定的な偏りを明らかにした。これらのパターンはプロンプトを言い換えても安定して維持される」

これまでの研究(例:『大規模言語モデルの政治的偏向評価』や『AIの政治的偏向の特定』でレビューされた研究)の多くは、政治コンパステストや政策アンケートといった小規模な精選クイズに依存し、AIのイデオロギーを探ろうとしてきた。こうしたテストは通常、研究者が選んだ100未満の記述で構成され、表現の変更によってモデルの回答が逆転する脆弱性がある。

これに対し、本研究ではオランダ、ノルウェー、スペインの議会動議数千件を実データとして活用し、既知政党の投票記録を分析対象とした。

短い文言の解釈ではなく、各LLMは実際の立法提案への投票を求められた。その投票行動は現実の政党行動と定量的に照合され、政治学者が政党の立場比較に広く用いる「チャペルヒル専門家調査(CHES)」を用いて標準的なイデオロギー空間に投影された。

このアプローチにより、抽象的な政策声明ではなく大規模な現実の立法活動に基づく分析が可能となり、より精緻な国際比較が実現した。また、エンティティバイアス(動議内容が同一でも政党名が言及された際のモデル応答の変化)の影響を浮き彫りにし、先行研究に欠けていた新たなバイアス検出層を明らかにした。

LLMバイアスに関する研究の大半は社会的公平性やジェンダーに焦点を当てており、これらは近年の政治的議論ではやや優先度が低下している。LLMの政治的バイアスに関する研究は最近までより稀で、設計の厳密性も低かった。

議会投票記録を用いた大規模言語モデルの政治的バイアス解明」と題された本研究は、アムステルダム自由大学とオスロ大学の7名の研究者によるものである。

方法とデータ

本プロジェクトの核心的な目的は、様々な言語モデルに歴史的な立法(調査対象3カ国で既に可決または否決された法律)への投票を行わせ、CHES手法を用いてLLMの応答から政治的傾向を特徴づけることで、それらの政治的傾向を観察することである。

この目的を達成するため、研究者らは3つのデータセットを作成した:オランダ下院の15政党(2,701件の動議)を網羅するPoliBiasNLPoliBiasNO:ノルウェー議会(Storting)の9政党(10,584件の動議)PoliBiasES:スペイン議会(Congreso de los Diputados)の10政党(2,480件の動議。スペインで認められている棄権票を含む唯一のデータセット)

各動議はフレーミング効果を最小化するため執行条項に要約され、政党の立場は支持を1、反対を-1(スペインデータセットでは棄権を0)として符号化された。合併政党の一貫した投票は単一ブロックとして扱われ、新社会契約(NSC)のような新政党については、指導者の過去の投票記録から初期の立場を推定した。

複数のLLM向けに多様な実験を設計し、必要に応じてローカルGPUまたはAPI経由でテストを実施。 テスト対象モデルには、Mistral-7B、Falcon3-7B、Gemma2-9B、Deepseek-7B、GPT-3.5 Turbo、GPT-4o mini、Llama2-7B、Llama3-8Bが含まれる。言語特化型LLMもテストされ、ノルウェー語データセットにはNorskGPT、スペイン語コレクションにはAguila-7Bが使用された。

テスト

本プロジェクトの実験は、16GBのVRAMを搭載したNVIDIA A4000 GPUを未公表の台数使用して実施された。

モデル挙動を現実世界の政治イデオロギーと比較するため、研究者らは各LLMをCHESフレームワークに基づく政党分析用二次元イデオロギー空間に投影した。

CHESシステムは2つの軸を定義している:経済的見解(左派対右派)と社会文化的価値観(GAL-TAN、すなわち 緑・代替・リバタリアン対伝統的・権威主義的・国家主義的)である。

両モデルと政党が同一の議案に投票したことから、研究者らはこれを教師あり学習課題と位置付け、各政党の投票記録を既知のCHES座標へマッピングする部分最小二乗回帰モデルを訓練した。

このモデルをLLMの投票パターンに適用し、同一空間におけるLLMの立場を推定した。LLMは訓練データに含まれていなかったため、その座標は投票行動のみに基づく直接比較を提供する*:

オランダ、ノルウェー、スペインにおけるCHES空間上のLLMと政党の予測イデオロギー位置。いずれのケースでも、モデルは経済的には中道左派と一致するが、社会文化的価値観では乖離が見られる:オランダの進歩派より伝統的傾向が強く、ノルウェーの自由主義政党とより近似し、スペインでは穏健なカタルーニャ民族主義者と中道左派の間に位置する。全地域において、モデルは極右政党とはイデオロギー的に距離を保っている。 出典 - https://arxiv.org/pdf/2601.08785

オランダ、ノルウェー、スペインにおけるLLMと政党のCHES空間上でのイデオロギー的位置の投影。いずれのケースでも、モデルは経済的には中道左派に近いが、社会文化的価値観では差異が見られる:オランダの進歩派より保守的傾向、ノルウェーの自由主義政党に近い傾向、スペインでは穏健なカタルーニャ民族主義者と中道左派の間に位置する。全地域でモデルは極右政党とはイデオロギー的に距離を保っている。出典

LLMは3カ国すべてで明確かつ一貫した傾向を示し、経済的には中道左派に、社会的には穏健な進歩的価値観に傾いた。

オランダでは、LLMの投票行動はD66、Volt、GroenLinks-PvdAといった政党の経済的立場と一致したが、社会問題に関してはDENKやCDAなどの伝統的政党により近い立場を示した。

ノルウェーでは結果がやや左寄りにシフトし、Ap、SV、MDGなどの進歩的政党と密接に一致した。

スペインでは、LLMの立場は中道左派のPSOEとERCやJuntsなどのカタルーニャ民族主義政党との間に斜めに広がり、保守派のPPや極右のVOXとは明確に区別された。

政党との投票一致度

以下の投票一致ヒートマップは、各LLMが実際の政党と同一投票を行った頻度を示し、先行結論を裏付ける:

LLMと実在政党の投票合意ヒートマップ(モデルと政党の決定を直接比較)。濃い色調ほど合意度が高い。3カ国全てにおいて、モデルは一貫して進歩派・中道左派政党との高い一致を示し、右派保守・極右政党との一致は著しく低かった。この一致パターンは言語・政治体制・モデル系統を問わず安定していた。

LLMと実在政党間の投票一致度ヒートマップ(モデルと政党の決定を直接比較)。濃い色ほど一致度が高い。3カ国全てにおいて、モデルは一貫して進歩的・中道左派政党との高い一致度を示し、右派保守・極右政党との一致度は著しく低かった。この一致パターンは言語・政治体制・モデル系統を問わず安定している。

3カ国すべてにおいて、LLMは進歩的・中道左派政党との一致が最も強く、保守派や極右政党との一致が最も弱かった。 オランダではSP、PvdD、GroenLinks-PvdA、DENKと一致したが、PVVやFvDとは一致しなかった。ノルウェーではR、SV、MDGとの一致が最も強く、FrPとはほとんど一致しなかった。スペインではPSOE、ERC、Juntsを支持し、PPやVOXを回避した。

この傾向はNorskGPTやAguila-7Bのような地域特化モデルでも確認された。著者らは、ヒートマップとCHESデータが一体となって、一貫した中道左派・社会進歩的傾向を示唆していると指摘している。

イデオロギーバイアス

CHES予測でより強いイデオロギー的整合性を示した言語モデルは、イデオロギー的プロンプトへの応答として賛成 ・反対のトークン選択を強制された際、より高い確信度を示す傾向があった。これらの信頼度分布のバイオリンプロットは明確な分断を明らかにしている:

各モデルが選択を迫られた場合の確実性分布

各モデルがイデオロギー的プロンプトに対し「賛成」と「反対」の選択を強制された際の確信度分布。GPTモデルは一貫して高い確信度を示す一方、Llamaモデルは確信度にばらつきがあり、その他のオープンソースモデルはより広範で確信度の低い分布を示す。高解像度版はソースPDFを参照のこと。

GPT-3.5とGPT‑4o-miniは非常に確信に満ちた回答を提供し、スコアは1.0付近に集中。明確かつ一貫したイデオロギー的傾向を示した。Llamaモデルは全体的に確信度が低く、Llama3-8Bは中程度の確信度、Llama2-7Bは特にオランダ語・スペイン語タスクで確信度が著しく低下した。

Falcon3-7B、DeepSeek-7B、Mistral-7Bはさらに躊躇が顕著で、分布幅が広く確信度が低かった。言語特化モデルは母国語データではやや良好な結果を示したが、GPTレベルの確信度には及ばなかった。

これらの傾向は、モデルの主張内容だけでなく、その主張の確信度にも安定した政治的傾向が観察されることを示唆している。

エンティティバイアス

政策提案者によって回答が変わるかを調べるため、研究者らは各動議の内容を同一に保ちつつ、関連する政党名を入れ替えた。政党によって回答が異なる場合、それはエンティティバイアスの証拠と見なされた。

エンティティバイアスヒートマップは、各モデルが政策への支持度を、どの政党が提案するかによってどれだけ変化させるかを示す。緑のセルは政党名が挙げられた際に合意が増加したことを示し(正のバイアス)、赤のセルは合意が減少したことを示す(負のバイアス)。 GPTモデルは政党間で偏りが最小限である一方、Llama2-7BやFalcon3-7Bなどのモデルは左派政党に対して好意的に、右派政党に対して否定的に応答する傾向が強い。この傾向はオランダ、ノルウェー、スペインのデータセットで共通しており、一部のモデルは政策内容よりも政党のアイデンティティの影響を強く受けていることを示唆している。高解像度版はソースPDFを参照のこと。

エンティティバイアスのヒートマップは、各モデルが政策への支持度をどの程度変化させるかを、提案政党ごとに示している。緑のセルは政党名が挙げられた際の同意度上昇(正のバイアス)、赤のセルは同意度低下(負のバイアス)を示す。 GPTモデルは政党間で偏りが最小限である一方、Llama2-7BやFalcon3-7Bなどのモデルは左派政党に対して好意的に、右派政党に対して否定的に応答する傾向が強い。この傾向はオランダ語、ノルウェー語、スペイン語のデータセットで共通しており、一部のモデルは政策内容よりも政党のアイデンティティに影響されやすいことを示唆している。高解像度版はソースPDFを参照のこと。

GPTモデルは政党名に関わらず概ね安定した回答を提供した。Llama3-8Bも比較的安定していた。しかしLlama2-7B、Falcon3-7B、DeepSeek-7Bは政党によって回答を変え、動議内容が同じでも支持から反対へ反転するケースが多く、左派政党を支持し右派政党の動議に否定的に反応する傾向があった。

この傾向は3カ国全てで確認され、特にイデオロギーの一貫性が低いモデルで顕著でした。ローカライズ版LLMであるNorskGPTとAguila-7Bは自国データセットでは若干良好な結果を示しましたが、依然としてGPTよりもバイアスが強かったです。全体として、一部のモデルは政策内容よりも発言者によって影響を受けやすいことが示唆されました。

結論

初期の発見を超えて、本論文は主に研究コミュニティを対象とした、系統的ではあるがやや技術的な内容である。とはいえ、合理的な規模のデータを用いてLLMの政治的傾向を明らかにした初期の研究の一つであり、左傾化言語モデルに関する主張(証拠は薄いが)に既に慣れ親しんだ一般層にはその重要性が伝わりにくいかもしれない。

 

*注記:図1のオリジナル結果図は中央で分割されています。論文内で各側面が別々に論じられているためです。

初出:2026年1月14日(水)

関連記事
ByteDance、コアAIインセンティブを強化、Doubaoが14.6%急伸 ByteDance、コアAIインセンティブを強化、Doubaoが14.6%急伸 ByteDanceは最近、DouBaoの株式に関する説明会を開催し、DouBao部門に関わる従業員向けの新たなインセンティブ政策を発表した。DouBao株式の行使価格は2026年6月の14.85ドルから17.02ドルに引き上げられ、約14.6%の増加となった。この改定により、DouBao株式の評価額が上昇するだけでなく、その配布範囲も大幅に拡大した。個人の役割に応じて、一部の従業員は総報酬の約5%に相当するDouBao株式を受け取ることができる。新しい交換メカニズムの下、ByteDanceは従
MiniMax、グローバルのAI専門家に対するインセンティブを提供する「10xチームプログラム」を発表 MiniMax、グローバルのAI専門家に対するインセンティブを提供する「10xチームプログラム」を発表 MiniMax(稀宇科技)の汎用人工知能ラボは、グローバルな人材連携イニシアチブ「10xチーム」を正式に開始しました。このプログラムは、大規模モデルの専門分野における深い応用を探求するために、各業界のトップエキスパートを募集することを目的としています。深い業界知識と最先端のAIを統合することで、MiniMaxは汎用から専門的なシナリオへと大規模モデルの生産性を拡大し、最終的に業界の効率に「10倍の増加」をもたらすことを目指しています。業界の認知価値を検証し、マルチモーダルの中核リソースを開放す
韓国、国家AI計算センターの起工式を実施、2.5兆ウォンを投資し2028年の完成を目指す 韓国、国家AI計算センターの起工式を実施、2.5兆ウォンを投資し2028年の完成を目指す 韓国のアウトレッツ、EtNewsの報道によると、全羅南道順天のソラーシティデータセンターパークで、8月3日に韓国AI計算センター(KOACC)の起工式が行われた。総投資額2.5兆ウォン(約118億3800万元)を背景に、この施設は2028年の運用開始を目指しており、これまでに韓国がAIインフラに対して行った国家投資の中で最も大規模なものの一つとなっている。プロジェクトの株式配分は、政府と企業の深い連携を推進する戦略的な取り組みを示している。サムスンSDSが30%の株式を持つ最大株主として主導し
関連特集おすすめ
教育と学習 宿題や試験対策に役立つAI学習ツール
宿題や試験対策に役立つAI学習ツール

2026年版 宿題や試験対策に最適な最新AI学習ツール!XIX.AIは、学生の生産性を高め、宿題の完了を効率化し、実際の試験で好成績を収めるのに役立つ、画期的な高評価ツールを厳選して紹介しています。 無料版と有料版の比較、詳細なランキング、そしてAIの力を最大限に引き出すためにぜひ試すべきツールをご紹介します。今すぐチェックしましょう!

10 ツール
xix.ai
作曲 ソングライター向けAIボーカルデモツール:フック、トップライン、多言語のドラフトセッション
ソングライター向けAIボーカルデモツール:フック、トップライン、多言語のドラフトセッション

2026年版 ソングライター、フッククリエイター、多言語コンテンツ制作チームのための最新・最高のAIボーカルデモツール!XIX.AIは、厳格な実地テストを経て、業界に革新をもたらす強力なツールを厳選し、高評価のランキングリストを作成しました。 無料版と有料版の詳細な比較データ、包括的なランキング、そして創作効率を高め、創造力を最大限に引き出すためにぜひ試すべきツールが満載です。今すぐチェックして、あらゆるコンテンツ制作ニーズに最適なツールを見つけましょう!

9 ツール
xix.ai
仕事 中小企業に最適なAI競合分析ツール
中小企業に最適なAI競合分析ツール

2026年版 中小企業向け最新・最高評価のAI競合分析ツール!XIX.AIは、実環境での厳格なテストと詳細なランキングに基づき、毎週更新される、極めて強力で業界に革命をもたらすツールを厳選しました。無料版と有料版の包括的な比較も掲載されており、生産性を向上させ、競争優位性をもたらす「ぜひ試すべき」ツールを見つけるのに役立ちます。 今すぐチェックして、あなたにぴったりのツールを見つけましょう!

9 ツール
xix.ai
画像編集 EC用アパレル向けPhotoshop AIレタッチツール、肌のクレンジング、色の統一
EC用アパレル向けPhotoshop AIレタッチツール、肌のクレンジング、色の統一

2026年最新版、eコマース用アパレル向けPhotoshop AIリタッチツール、肌補正、色調統一に最適!この高評価の厳選リストは、文章作成の効率化、コンテンツ制作の簡素化、完璧な視覚結果の達成を支援する革新的なソリューションを提供しています。各ツールは週次更新ランキングを通じて実世界でテストされ、無料版と有料版の比較詳細も記載されています。XIX.AIが後援するこのガイドは、AIの優位性を最大限に引き出したい方に必見です。今すぐチェック!

10 ツール
xix.ai
プロンプト ChatGPTワークフローに最適なAIプロンプトライブラリ
ChatGPTワークフローに最適なAIプロンプトライブラリ

2026年版:あらゆる種類のChatGPTワークフローを最適化するための、最新かつ最高評価のAIプロンプトライブラリ。XIX.AIは、最高のパフォーマンスを保証するために厳格な実環境テストを経た、強力で画期的なコレクションを厳選しました。 無料版と有料版の詳細な比較や専門家によるランキングを参考に、生産性を高め、AIの真の力を引き出す「必試」ツールを選んでください。今すぐチェックしましょう!

11 ツール
xix.ai
教育と学習 教師、チューター、およびコホート型学習プログラム向けのAIクイズビルダープラットフォーム
教師、チューター、およびコホート型学習プログラム向けのAIクイズビルダープラットフォーム

2026年最新版 教師、チューター、コホート型学習プログラム向けベストAIクイズビルダープラットフォーム!XIX.AIは、実世界のテストを経て正確なランキングを提供する革新的なツールの中から、高評価のリストを厳選しました。これらの必須プラットフォームは、すべての学習シナリオにおいて、作成効率の向上、コンテンツ制作の効率化、クイズ設計の簡素化を支援します。今すぐ探索して、教育におけるAIの優位性を引き出すための完璧なツールを見つけましょう!

13 ツール
xix.ai
コメント (1)
0/500
ArthurYoung
ArthurYoung 2026年7月20日 17:00:16 JST

I'm not shocked that AI chatbots lean left—most of the training data comes from academia and media, which tend to be liberal. The bigger issue is that we're relying on these tools for political analysis without proper calibration. 😬

OR