何百万人もの人々がニュース、政治的議論、さらには投票方法についての答えを求めて AI チャットボットに頼っている中、新しい研究では不快な質問が投げかけられています。モデルが私たちの意見に同意しない場合、モデルはどちらに傾くのでしょうか?

分析スタートアップの Trakkr が 2026 年 6 月に公開したプロジェクトは、まさにそれをマッピングすることを目指しました。研究者らは、すべての主要な AI モデルに、政治、経済、言論、社会に関する同様の一連の質問を行った。その結果、見出しの発見は、それらのほとんどが同じ方向に傾いているということだが、ただし、一般の観察者が想定するほど同じ量ではなく、それほど明確ではない。 この件の詳細は、人工知能の最新情報をご覧ください。

研究の仕組み

Trakkr の方法論によると、Web 検索をオフにし、システム プロンプトを適用せずに、各モデルに同じ自由回答形式の質問が何度も質問されました。その詳細が重要です。取得が無効になっていると、読み取り値は、その時点でオンラインに何が起こっているかに関係なく、モデル自体がどのような方向に傾いているかを反映します。

次に、別の中立分類子が各生の回答を読み取り、署名されたスタンス、ヘッジの程度、拒否の種類、および読み込まれた言語を記録します。結果は 95% 信頼区間の加重平均としてプロットされ、スコアを再計算できるようにすべての生の回答が永続的に保存されました。

重要なのは、各モデルが 単一点ではなく雲として表示されていることです。すべてのモデルは何度も実行されるため、ビジュアライゼーションでは、実行全体でモデルが着地した場所の全体像がキャプチャされ、単一のラベルよりも正確な画像が得られます。

2026 年 6 月 17 日までに収集されたデータの時点で、この調査では 6 つのモデルと 4,400 を超える回答が対象となっています。

調査結果

モデルは、左から右に向かう経済軸と、自由主義者から権威主義者に向かう社会軸の 2 つの軸にわたってマッピングされています。

6 つのモデルのうち 4 つは中央より左に傾いています。 際立った例外はスペクトルの両端にあります。
  • Grok は、テストしたすべてのモデルの最も右側で測定され、特にどちらに傾いているかを直接尋ねたところ、主張よりも約 0.36 右側に測定されました。
  • ジェミニは最も安定したモデルであり、経済軸の最も中心に近い位置にありました。

モデルが言うことと実際に行うこととの間のギャップは、この研究で最も明らかな指標の 1 つであることが判明しました。クロードは自己申告よりもさらに左に約0.34を計測した。 ChatGPT と Meta's Llama は両方とも中立を主張しましたが、それぞれおよそ 0.29 と 0.17 左寄りでした。 DeepSeek はほぼ中心に位置し、それ自体の説明とほぼ一致していました。

判決ではなく地図

Trakkr は、作品を規範的ではなく説明的なものとして構成するよう注意しています。このプロジェクトは、誰が正しいかを判断することなく、モデルの発言を報告します。カラーパレットは意図的に米国政治の赤と青ではなく、分析はどちらの極が好ましいかを示唆するものではありません。

抽象的な座標に意味を与えるために、研究者らは、現実世界の参照数字(国家元首、政党指導者、政治運動)を使用して地図を固定しました。その位置は、チーム独自の判断ではなく、確立された専門家調査、具体的には2024年のチャペルヒル専門家調査(CHES)とV-Demデータセットに基づいています。

この研究はまた、モデルを最も分断する特定の質問、各モデルが温かく賞賛する、または批判を拒否する現実世界の人物、および異なる国や言語の観点から同じモデルを再検討する「世界観」レンズも分析します。

なぜそれが重要なのか

透明性の推進は、AI システムが公共の議論をどのように形成するかについての監視が強化される中で行われています。モデルの傾向は、それが微妙なものであっても、ニュース記事を要約したり、政策のトレードオフを比較検討したり、政治家を特徴づけたりする方法を静かに方向付けることができます。チャットボットの回答は中立的な権威を持った雰囲気で届くことが多いため、ユーザーはそのズレを検出する方法をほとんど持っていません。

Trakkr は、スコアリングの重みを付けたオープンクエスチョンバンクを公開し、各項目を事実ベースまたは値ベースとしてタグ付けし、基礎となるデータをクリエイティブコモンズライセンスに基づいて公開することで、外部の研究者を招待して研究を検証し、拡張してもらっています。これは、モデルを構築している研究所が発表する、しばしば不透明な評価とは対照的です。

限界

この研究では重要な注意点が認められています。政治的立場は多面的であり、それを 2 つの軸に圧縮すると、必然的にニュアンスが失われます。答えは言い回し、言語、地域によって変わる可能性があるため、チームは実行ごとの安定性を測定し、別の「境界テスト」を実行して、Web 検索をオンに戻すと場所ごとに結果がどのように変化するかを確認します。

これらはいずれも、モデルが意図的に党派的であることを証明するものではありません。しかし、このことは、主要な AI システムが同じ立場を占めているわけではないこと、そして何百万もの人々が論争の的となっている質問について AI システムに相談すると、それらの小さな違いが積み重なることを示しています。

---

AIの最新情報をお届け

AIの最新ニュース、分析、ブレイクスルーを一箇所で。

AIニュースをもっと読む →