Ketika berjuta-juta orang beralih kepada chatbots AI untuk mendapatkan jawapan mengenai berita, hujah politik, dan juga cara mengundi, satu kajian baharu mengajukan soalan yang tidak selesa: apabila model tidak bersetuju dengan kami, ke arah manakah mereka bersandar?

Projek yang diterbitkan oleh permulaan analitik Trakkr pada Jun 2026 bertujuan untuk memetakan perkara itu. Para penyelidik meletakkan setiap model AI utama melalui bateri soalan yang sama tentang politik, ekonomi, pertuturan dan masyarakat - dan penemuan utama ialah kebanyakan mereka bersandar dengan cara yang sama, walaupun tidak dengan jumlah yang sama dan tidak sebersih yang mungkin diandaikan oleh pemerhati biasa. For more context on this story, see our ongoing artificial intelligence updates.

Bagaimana Kajian Berfungsi

Menurut metodologi Trakkr, setiap model ditanya bank soalan terbuka yang sama berkali-kali, dengan carian web dimatikan dan tiada gesaan sistem digunakan. Perincian itu penting: dengan pengambilan semula dilumpuhkan, bacaan mencerminkan apa yang model itu sendiri condong ke arah, bebas daripada apa sahaja yang berlaku dalam talian pada masa ini.

Pengelas neutral yang berasingan kemudian membaca setiap jawapan mentah, merekodkan pendirian yang ditandatangani, tahap lindung nilai, jenis penolakan dan sebarang bahasa yang dimuatkan. Keputusan telah diplot sebagai min wajaran dengan selang keyakinan 95 peratus, dan setiap jawapan mentah disimpan secara kekal supaya markah boleh dikira semula.

Yang penting, setiap model ditunjukkan sebagai awan dan bukannya satu titik. Oleh kerana setiap model dijalankan berkali-kali, visualisasi menangkap penyebaran penuh tempat ia mendarat merentasi larian — gambar yang lebih jujur ​​daripada satu label.

Sehingga data yang dikumpul hingga 17 Jun 2026, kajian itu meliputi enam model dan lebih daripada 4,400 jawapan.

Penemuan

Model tersebut dipetakan merentasi dua paksi: paksi ekonomi berjalan dari kiri ke kanan, dan paksi sosial berjalan dari libertarian kepada autoritarian.

Empat daripada enam model condong ke kiri tengah. Pengecualian yang menonjol terletak pada hujung spektrum yang bertentangan:
  • Grok diukur paling jauh di sebelah kanan mana-mana model yang diuji, dan terutamanya mengukur kira-kira 0.36 lebih kanan daripada yang didakwa apabila ditanya secara langsung ke arah mana ia bersandar.
  • Gemini ialah model paling mantap, duduk paling hampir dengan pusat mati pada paksi ekonomi.

Jurang antara perkara yang dikatakan model dan perkara yang dilakukannya terbukti sebagai salah satu metrik kajian yang paling mendedahkan. Claude mengukur sekitar 0.34 lebih jauh ke kiri daripada yang dilaporkan sendiri. ChatGPT dan Meta Llama kedua-duanya mendakwa berkecuali namun diukur ke kiri, masing-masing kira-kira 0.29 dan 0.17. DeepSeek mendarat berhampiran pusat dan sebahagian besarnya sepadan dengan perihalan dirinya sendiri.

Peta, Bukan Keputusan

Trakkr berhati-hati untuk merangka kerja sebagai deskriptif dan bukannya preskriptif. Projek itu melaporkan apa yang dikatakan model tanpa memutuskan siapa yang betul. Palet warna sengaja bukan merah-biru politik Amerika Syarikat, dan analisis tidak pernah membayangkan kutub mana yang lebih baik.

Untuk memberi makna koordinat abstrak, para penyelidik melabuhkan peta menggunakan angka rujukan dunia sebenar — ketua negara, pemimpin parti dan pergerakan politik — yang jawatannya datang daripada tinjauan pakar yang mantap, khususnya Tinjauan Pakar Chapel Hill (CHES) 2024 dan set data V-Dem, dan bukannya penilaian pasukan itu sendiri.

Kajian itu juga memecahkan soalan khusus yang paling membahagikan model, tokoh dunia sebenar yang dipuji oleh setiap model dengan hangat atau enggan mengkritik, dan lensa "pandangan dunia" yang mengkaji semula model yang sama dari perspektif negara dan bahasa yang berbeza.

Mengapa Ia Penting

Dorongan ketelusan datang di tengah-tengah penelitian yang semakin intensif tentang cara sistem AI membentuk wacana awam. Model yang kurus, malah model yang halus, boleh mengemudi secara senyap-senyap cara ia meringkaskan cerita berita, menimbang pertukaran dasar atau mencirikan ahli politik. Oleh kerana jawapan chatbot selalunya tiba dengan aura kuasa neutral, pengguna jarang mempunyai cara untuk mengesan hanyut itu.

Dengan menerbitkan bank soalan terbuka dengan pemberat pemarkahan, menandai setiap item sebagai fakta atau berasaskan nilai, dan mengeluarkan data asas di bawah lesen Creative Commons, Trakkr menjemput penyelidik luar untuk mengesahkan dan melanjutkan kerja - berbeza dengan penilaian yang sering tidak jelas yang dikeluarkan oleh makmal yang membina model itu sendiri.

Had

Kajian itu mengakui kaveat penting. Pendirian politik adalah multidimensi, dan memampatkannya pada dua paksi pasti kehilangan nuansa. Jawapan boleh beralih mengikut frasa, bahasa dan rantau, itulah sebabnya pasukan mengukur kestabilan run-to-run dan menjalankan "ujian sempadan" yang berasingan untuk melihat cara menghidupkan kembali carian web mengubah hasil mengikut lokasi.

Tiada satu pun daripada ini membuktikan bahawa mana-mana model sengaja berpihak. Tetapi ia menunjukkan bahawa sistem AI utama tidak menduduki tempat yang sama - dan apabila berjuta-juta orang berunding dengan mereka mengenai soalan yang dipertikaikan, perbezaan kecil itu bertambah.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →