Pe măsură ce milioane de oameni apelează la chatbots AI pentru răspunsuri la știri, argumente politice și chiar cum să voteze, un nou studiu pune o întrebare inconfortabilă: când modelele nu sunt de acord cu noi, în ce direcție se înclină?

Un proiect publicat de startup-ul de analiză Trakkr în iunie 2026 și-a propus să cartografieze exact asta. Cercetătorii au pus fiecare model AI major prin aceeași baterie de întrebări încărcate despre politică, economie, vorbire și societate - iar concluzia principală este că majoritatea dintre ei se înclină în același mod, deși nu în aceeași cantitate și nu atât de clar pe cât ar putea presupune observatorii ocazionali. For more context on this story, see our ongoing AI news.

Cum a funcționat studiul

Conform metodologiei lui Trakkr, fiecărui model i s-a adresat aceeași bancă de întrebări deschise de multe ori, cu căutarea pe web dezactivată și nicio solicitare de sistem aplicată. Acest detaliu contează: cu recuperarea dezactivată, citirile reflectă spre ce se înclină modelul însuși, independent de ceea ce se întâmplă să fie online în acest moment.

Un clasificator neutru separat citește apoi fiecare răspuns brut, înregistrând o poziție semnată, gradul de acoperire, tipul de refuz și orice limbaj încărcat. Rezultatele au fost reprezentate grafic ca medii ponderate cu intervale de încredere de 95% și fiecare răspuns brut a fost stocat permanent, astfel încât scorurile să poată fi recalculate.

În mod esențial, fiecare model este afișat ca un nor mai degrabă decât un singur punct. Deoarece fiecare model a fost rulat de mai multe ori, vizualizarea surprinde întreaga răspândire a locului în care a aterizat pe rânduri - o imagine mai sinceră decât o singură etichetă.

Din datele colectate până la 17 iunie 2026, studiul a acoperit șase modele și peste 4.400 de răspunsuri.

Constatările

Modelele sunt mapate pe două axe: o axă economică care merge de la stânga la dreapta și o axă socială care merge de la libertarian la autoritar.

Patru dintre cele șase modele sunt înclinate spre stânga centrului. Excepțiile remarcabile se află la capetele opuse ale spectrului:
  • Grok a măsurat cel mai departe în dreapta oricărui model testat și, în special, a măsurat aproximativ 0,36 mai în dreapta decât a susținut când a fost întrebat direct în ce direcție se înclină.
  • Gemeni a fost cel mai stabil model, așezat cel mai aproape de punctul mort pe axa economică.

Diferența dintre ceea ce spune un model și ceea ce face s-a dovedit a fi una dintre cele mai revelatoare valori ale studiului. Claude a măsurat cu aproximativ 0,34 mai departe la stânga decât a auto-raportat. ChatGPT și Llama lui Meta au pretins ambele neutralitate, dar măsurată la stânga, cu aproximativ 0,29 și, respectiv, 0,17. DeepSeek a aterizat în apropierea centrului și s-a potrivit în mare măsură cu propria sa autodescriere.

O hartă, nu un verdict

Trakkr are grijă să încadreze lucrarea mai degrabă ca descriptivă decât ca prescriptivă. Proiectul raportează ce au spus modelele fără a se pronunța asupra cine are dreptate. Paleta de culori nu este în mod deliberat roșu-albastru din politica Statelor Unite, iar analiza nu implică niciodată care pol este de preferat.

Pentru a da semnificație coordonatelor abstracte, cercetătorii au ancorat harta folosind figuri de referință din lumea reală - șefi de stat, lideri de partide și mișcări politice - ale căror poziții provin din sondaje ale experților consacrați, în special din 2024 Chapel Hill Expert Survey (CHES) și setul de date V-Dem, mai degrabă decât din propria judecată a echipei.

Studiul defalcă, de asemenea, întrebările specifice care împart cele mai multe modele, cifrele din lumea reală pe care fiecare model le laudă cu căldură sau refuză să critice și o lentilă de „viziune asupra lumii” care reexaminează aceleași modele din perspectiva diferitelor țări și limbi.

De ce contează

Impulsul transparenței vine pe fondul unui control intens al modului în care sistemele AI modelează discursul public. Înclinația unui model, chiar și una subtilă, poate ghida în liniște modul în care rezumă o știre, cântărește un compromis de politică sau caracterizează un politician. Deoarece răspunsurile la chatbot ajung adesea cu un aer de autoritate neutră, utilizatorii rareori au o modalitate de a detecta această deriva.

Publicând o bancă de întrebări deschise cu ponderi de punctare, etichetând fiecare articol ca fiind faptice sau bazate pe valori și eliberând datele subiacente sub o licență Creative Commons, Trakkr invită cercetători externi să verifice și să extindă munca - un contrast cu evaluările adesea opace lansate de laboratoarele care construiesc modelele în sine.

Limitele

Studiul recunoaște avertismente importante. Poziția politică este multidimensională, iar comprimarea ei pe două axe pierde inevitabil nuanța. Răspunsurile se pot schimba în funcție de frază, limbă și regiune, motiv pentru care echipa măsoară stabilitatea între rulări și efectuează un „test de frontieră” separat pentru a vedea cum refacerea căutării pe web modifică rezultatele în funcție de locație.

Nimic din toate acestea nu dovedește că orice model este în mod deliberat partizan. Dar arată că sistemele AI majore nu ocupă un teren identic - și că atunci când milioane de oameni le consultă cu privire la întrebări contestate, acele mici diferențe se adună.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →