В то время как миллионы людей обращаются к чат-ботам с искусственным интеллектом за ответами на новости, политические аргументы и даже о том, как голосовать, новое исследование задает неудобный вопрос: когда модели с нами не согласны, в какую сторону они склоняются?
Проект, опубликованный аналитическим стартапом Trakkr в июне 2026 года, призван отобразить именно это. Исследователи подвергли каждую крупную модель ИИ одному и тому же набору острых вопросов о политике, экономике, речи и обществе — и главный вывод заключается в том, что большинство из них склоняются одинаково, хотя и не в такой же степени и не так чисто, как могли бы предположить случайные наблюдатели. Подробнее об этой истории — в нашем тенденции ИИ.
Как работало исследование
Согласно методологии Trakkr, каждой модели многократно задавался один и тот же набор открытых вопросов, при этом веб-поиск был отключен и системные подсказки не применялись. Эта деталь имеет значение: при отключенном извлечении показания отражают то, к чему склоняется сама модель, независимо от того, что происходит в сети в данный момент.
Затем отдельный нейтральный классификатор считывал каждый необработанный ответ, записывая подписанную позицию, степень хеджирования, тип отказа и любые загруженные формулировки. Результаты были представлены как взвешенные средние значения с 95-процентным доверительным интервалом, и каждый необработанный ответ постоянно сохранялся, чтобы можно было пересчитать баллы.
Важно отметить, что каждая модель отображается как облако, а не как отдельная точка. Поскольку каждая модель запускалась много раз, визуализация отражает полный разброс результатов по всем запускам — более честная картина, чем один ярлык.
По данным, собранным по 17 июня 2026 года, исследование охватило шесть моделей и более 4400 ответов.
Выводы
Модели разбиты по двум осям: экономическая ось, идущая слева направо, и социальная ось, идущая от либертарианства к авторитаризму.
Четыре из шести моделей наклонены влево от центра. Выдающиеся исключения расположены на противоположных концах спектра:- Grok измерил крайнюю правую точку среди всех протестированных моделей и, в частности, измерил примерно на 0,36 правее, чем заявлено, когда его напрямую спросили, в какую сторону она наклоняется.
- Близнецы были самой устойчивой моделью, находившейся ближе всего к мертвой точке экономической оси.
Разрыв между тем, что говорит модель, и тем, что она делает, оказался одним из наиболее показательных показателей исследования. Клод измерил примерно на 0,34 левее, чем сообщил сам. ChatGPT и Llama от Meta заявили о своем нейтралитете, но отклонились влево примерно на 0,29 и 0,17 соответственно. DeepSeek расположился недалеко от центра и во многом соответствовал своему собственному описанию.
Карта, а не приговор
Trakkr старается сделать свою работу скорее описательной, чем предписывающей. Проект сообщает о том, что сказали модели, не определяя, кто прав. Цветовая палитра намеренно не является красно-синей, как в политике США, и анализ никогда не предполагает, какой полюс предпочтительнее.
Чтобы придать смысл абстрактным координатам, исследователи привязали карту к реальным эталонным фигурам — главам государств, партийным лидерам и политическим движениям — чьи позиции основаны на авторитетных экспертных опросах, в частности на экспертном опросе Чапел-Хилл 2024 года (CHES) и наборе данных V-Dem, а не на собственном суждении команды.
Исследование также раскрывает конкретные вопросы, которые больше всего разделяют модели, реальные цифры, которые каждая модель горячо хвалит или отказывается критиковать, а также призму «мировоззрения», которая пересматривает одни и те же модели с точки зрения разных стран и языков.
Почему это важно
Движение к прозрачности происходит на фоне усиления внимания к тому, как системы искусственного интеллекта формируют общественный дискурс. Тонкость модели, даже незначительная, может незаметно определять способ резюмирования новости, взвешивания политического компромисса или характеристики политика. Поскольку ответы чат-ботов часто поступают с видом нейтрального авторитета, у пользователей редко есть возможность обнаружить это отклонение.
Публикуя банк открытых вопросов с оценочными весами, помечая каждый элемент как основанный на фактах или ценностях и публикуя основные данные под лицензией Creative Commons, Trakkr приглашает сторонних исследователей проверить и расширить работу — в отличие от часто непрозрачных оценок, публикуемых лабораториями, которые сами создают модели.
Пределы
Исследование признает важные предостережения. Политическая позиция многомерна, и сжатие ее по двум осям неизбежно теряет нюансы. Ответы могут меняться в зависимости от формулировки, языка и региона, поэтому команда измеряет стабильность между запусками и запускает отдельный «пограничный тест», чтобы увидеть, как включение веб-поиска меняет результаты в зависимости от местоположения.
Ничто из этого не доказывает, что какая-либо модель является намеренно партийной. Но это показывает, что основные системы ИИ не занимают одинаковые позиции — и что когда миллионы людей консультируются с ними по спорным вопросам, эти небольшие различия складываются.
---
Будьте в курсе ИИПоследние новости, аналитика и прорывы в сфере ИИ — всё в одном месте.
Читать больше новостей об ИИ →

