Když se miliony lidí obracejí na chatboty s umělou inteligencí, aby jim odpověděly na zprávy, politické argumenty a dokonce i to, jak volit, nová studie si klade nepříjemnou otázku: když s námi modely nesouhlasí, ke kterému směru se přikloní?

Projekt zveřejněný analytickým startupem Trakkr v červnu 2026 se rozhodl přesně to zmapovat. Výzkumníci podrobili každý hlavní model umělé inteligence stejnou baterii nabitých otázek o politice, ekonomice, řeči a společnosti – a hlavním zjištěním je, že většina z nich se naklání stejným způsobem, i když ne o stejnou míru a ne tak čistě, jak by náhodní pozorovatelé mohli předpokládat. For more context on this story, see our ongoing artificial intelligence updates.

Jak studie fungovala

Podle metodologie Trakkr byl každý model mnohokrát dotázán na stejnou banku otevřených otázek, s vyhledáváním na webu vypnutým a bez použití systémových výzev. Na tomto detailu záleží: je-li vyhledávání deaktivováno, odečty odrážejí to, k čemu se přiklání samotný model, nezávisle na tom, co je v daný okamžik online.

Samostatný neutrální klasifikátor pak přečetl každou nezpracovanou odpověď a zaznamenal podepsaný postoj, stupeň zajištění, typ odmítnutí a jakýkoli nahraný jazyk. Výsledky byly vyneseny jako vážené průměry s 95procentním intervalem spolehlivosti a každá nezpracovaná odpověď byla trvale uložena, aby bylo možné skóre přepočítat.

Rozhodující je, že každý model je zobrazen jako oblak spíše než jeden bod. Vzhledem k tomu, že každý model byl spuštěn mnohokrát, vizualizace zachycuje úplné rozložení místa, kde se dostal do běhů – poctivější obrázek než jediný štítek.

K datům shromážděným do 17. června 2026 studie zahrnovala šest modelů a více než 4 400 odpovědí.

Zjištění

Modely jsou mapovány ve dvou osách: ekonomická osa běžící zleva doprava a sociální osa běžící od libertariánů k autoritářským.

Čtyři ze šesti modelů se naklánějí vlevo od středu. Nejvýraznější výjimky se nacházejí na opačných koncích spektra:
  • Grok měřil nejvíce vpravo od kteréhokoli testovaného modelu a zejména měřil asi o 0,36 dále vpravo, než tvrdil, když byl přímo dotázán, jakým směrem se naklání.
  • Gemini byl nejstabilnější model, který seděl nejblíže úvrati na ekonomické ose.

Rozdíl mezi tím, co model říká, a tím, co dělá, se ukázal být jednou z nejvíce odhalujících metrik studie. Claude měřil asi o 0,34 dále vlevo, než sám uvedl. ChatGPT a Meta's Llama oba prohlásili neutralitu, ale měřenou vlevo, zhruba 0,29 a 0,17. DeepSeek přistál blízko středu a do značné míry odpovídal vlastnímu popisu.

Mapa, ne verdikt

Trakkr dbá na to, aby dílo koncipovalo spíše jako popisné než normativní. Projekt informuje o tom, co řekly modely, aniž by rozhodoval o tom, kdo má pravdu. Paleta barev záměrně není červeno-modrá politiky Spojených států a analýza nikdy nenaznačuje, který pól je výhodnější.

Aby dali abstraktním souřadnicím smysl, vědci mapu ukotvili pomocí referenčních postav v reálném světě – hlav států, stranických vůdců a politických hnutí – jejichž pozice pocházejí ze zavedených odborných průzkumů, konkrétně z průzkumu Chapel Hill Expert Survey (CHES) 2024 a datového souboru V-Dem, spíše než z vlastního úsudku týmu.

Studie také rozebírá konkrétní otázky, které modely nejvíce rozdělují, skutečné postavy, které každý model vřele chválí nebo odmítá kritizovat, a objektiv „světonázoru“, který znovu zkoumá stejné modely z perspektivy různých zemí a jazyků.

Proč na tom záleží

Snaha o transparentnost přichází uprostřed intenzivnějšího zkoumání toho, jak systémy umělé inteligence utvářejí veřejný diskurz. Štíhlý model, dokonce i ten jemný, může tiše řídit způsob, jakým shrnuje novinový článek, zvažuje politický kompromis nebo charakterizuje politika. Protože odpovědi chatbotů často přicházejí s neutrální autoritou, uživatelé jen zřídka mají způsob, jak tento posun odhalit.

Zveřejněním otevřené banky otázek s váhami bodování, označením každé položky jako faktické nebo založené na hodnotách a zveřejněním podkladových dat pod licencí Creative Commons zve Trakkr externí výzkumníky, aby ověřili a rozšířili práci – což je v kontrastu s často neprůhlednými hodnoceními vydávanými laboratořemi, které samy sestavují modely.

Limity

Studie uznává důležitá upozornění. Politický postoj je multidimenzionální a jeho stlačování do dvou os nevyhnutelně ztrácí nuance. Odpovědi se mohou měnit s frázováním, jazykem a regionem, a proto tým měří stabilitu za běhu a provádí samostatný „hraniční test“, aby zjistil, jak zpětné přepnutí vyhledávání na webu mění výsledky podle místa.

Nic z toho nedokazuje, že jakýkoli model je záměrně stranický. Ukazuje to však, že hlavní systémy umělé inteligence nezabírají stejnou půdu – a že když s nimi miliony lidí konzultují sporné otázky, tyto malé rozdíly se sčítají.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →