Оскільки мільйони людей звертаються до чат-ботів зі штучним інтелектом, щоб отримати відповіді на новини, політичні аргументи та навіть як голосувати, нове дослідження ставить незручне запитання: коли моделі не погоджуються з нами, куди вони схиляються?
Проект, опублікований аналітичним стартапом Trakkr у червні 2026 року, мав на меті відобразити саме це. Дослідники поставили кожну основну модель штучного інтелекту на одну й ту саму батарею заряджених запитань про політику, економіку, мову та суспільство — і головний висновок полягає в тому, що більшість із них схиляються однаково, хоча й не так само й не так чітко, як могли б припустити випадкові спостерігачі. For more context on this story, see our ongoing breaking AI news.
Як працювало дослідження
Згідно з методологією Trakkr, кожній моделі задавали один і той же відкритий банк запитань багато разів, при цьому веб-пошук вимкнено і системна підказка не застосовувалася. Ця деталь має значення: якщо пошук вимкнено, показання відображають те, до чого схиляється сама модель, незалежно від того, що відбувається в Інтернеті в даний момент.
Потім окремий нейтральний класифікатор зчитує кожну необроблену відповідь, записуючи підписану позицію, ступінь хеджування, тип відмови та будь-яку завантажену мову. Результати були нанесені як зважені середні з 95-відсотковим довірчим інтервалом, і кожна необроблена відповідь зберігалася назавжди, щоб бали можна було перерахувати.
Важливо те, що кожна модель показана як хмара, а не одна точка. Оскільки кожну модель запускали багато разів, візуалізація фіксує повне розповсюдження того, де вона потрапила в серії — більш чесне зображення, ніж одна етикетка.
За даними, зібраними до 17 червня 2026 року, дослідження охопило шість моделей і понад 4400 відповідей.
Висновки
Моделі розподіляються на дві осі: економічну вісь, що проходить зліва направо, і соціальну вісь, що проходить від лібертаріанської до авторитарної.
Чотири з шести моделей розташовані ліворуч від центру. Виняткові винятки знаходяться на протилежних кінцях спектру:- Grok вимірюється найправіше з усіх перевірених моделей, і, зокрема, виміряно приблизно на 0,36 справа, ніж стверджувалося, коли його прямо запитали, у який бік він нахилений.
- Близнюки були найстабільнішою моделлю, яка знаходилася найближче до мертвої точки на економічній осі.
Розрив між тим, що говорить модель, і тим, що вона робить, виявився одним із найбільш показових показників дослідження. Клод виміряв приблизно на 0,34 ліворуч, ніж сам повідомив. ChatGPT і Llama від Meta заявили про нейтралітет, але виміряно ліворуч, приблизно 0,29 і 0,17 відповідно. DeepSeek приземлився неподалік від центру та значною мірою відповідав власному опису.
Карта, а не вирок
Trakkr обережно оформляє роботу як описову, а не приписну. Проект повідомляє про те, що сказали моделі, не вирішуючи, хто правий. Палітра кольорів навмисно не є червоно-блакитною в політиці Сполучених Штатів, і аналіз ніколи не означає, який полюс є кращим.
Щоб надати значення абстрактним координатам, дослідники закріпили карту, використовуючи реальні еталонні цифри — глав держав, лідерів партій і політичних рухів — чиї позиції випливають із визнаних експертних опитувань, зокрема опитування експертів Chapel Hill Expert Survey (CHES) 2024 року та набору даних V-Dem, а не власного судження команди.
Дослідження також розбиває конкретні питання, які найбільше розділяють моделі, реальні цифри, які кожна модель тепло хвалить або відмовляється критикувати, і «світоглядну» лінзу, яка переглядає ті самі моделі з точки зору різних країн і мов.
Чому це важливо
Поштовх до прозорості відбувається на тлі посиленого вивчення того, як системи ШІ формують публічний дискурс. Схильність моделі, навіть незначна, може спокійно керувати тим, як вона підсумовує новину, зважує політичний компроміс або характеризує політика. Оскільки відповіді чат-бота часто надходять із нейтральним авторитетом, користувачі рідко можуть виявити цей дрейф.
Публікуючи банк відкритих запитань із ваговими оцінками, позначаючи кожен елемент як фактичний або заснований на цінностях, і оприлюднюючи базові дані за ліцензією Creative Commons, Trakkr запрошує сторонніх дослідників перевірити та розширити роботу — на відміну від часто непрозорих оцінок, опублікованих лабораторіями, які самі створюють моделі.
Обмеження
Дослідження визнає важливі застереження. Політична позиція є багатовимірною, і її стискання на двох осях неминуче втрачає нюанси. Відповіді можуть змінюватися залежно від фраз, мови та регіону, тому команда вимірює стабільність виконання й проводить окремий «граничний тест», щоб побачити, як увімкнення веб-пошуку змінює результати за місцем розташування.
Жодне з цього не доводить, що будь-яка модель є свідомо партійною. Але це показує, що основні системи штучного інтелекту не займають ідентичну позицію — і що коли мільйони людей консультуються з ними щодо спірних питань, ці невеликі відмінності накопичуються.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →

