ИИ-модели оказались левыми: тест Political Compass показал политический уклон

Большинство популярных больших языковых моделей, включая GPT-4o, Claude 3.5 Sonnet, Gemini 1.5 Pro и Llama 3.1 405B, демонстрируют устойчивый либертарианско-левый уклон. Это выяснили исследователи из группы Unslop.run, протестировав модели с помощью методики «Политический компас». Единственным исклю

ИИ-модели оказались левыми: тест Political Compass показал политический уклон

Большинство популярных больших языковых моделей, включая GPT-4o, Claude 3.5 Sonnet, Gemini 1.5 Pro и Llama 3.1 405B, демонстрируют устойчивый либертарианско-левый уклон. Это выяснили исследователи из группы Unslop.run, протестировав модели с помощью методики «Политический компас». Единственным исключением стала китайская модель DeepSeek, показавшая центристские взгляды. Результаты ставят под сомнение нейтральность ИИ и требуют внимания как от разработчиков, так и от пользователей.

Как проводился тест и что он показал

Исследователи Unslop.run использовали классический Political Compass — методику, которая делит политические взгляды на четыре квадранта: авторитарные левые, авторитарные правые, либертарианские левые и либертарианские правые. Тест состоит из 62 вопросов, оценивающих экономические и социальные убеждения. Модели отвечали без специальной настройки, опираясь только на свои базовые знания.

Результаты оказались однозначными: GPT-4o получил координаты (-6.5, -5.2), Claude 3.5 Sonnet (-7.1, -4.8), Gemini 1.5 Pro (-5.9, -6.0), Llama 3.1 405B (-6.8, -5.5). Все они попали в левый либертарианский квадрант, который сочетает стремление к экономическому равенству с максимальной личной свободой. DeepSeek, напротив, оказался близок к центру: (-1.2, -1.8).

Почему ИИ-модели склоняются влево?

Исследователи предполагают, что уклон связан с обучающими данными. Большие языковые модели обучаются на текстах из интернета, где преобладают либеральные и левые взгляды, особенно в англоязычном сегменте. Кроме того, процесс RLHF (обучение с подкреплением на основе человеческой обратной связи) может усиливать этот эффект, так как асессоры, оценивающие ответы, часто сами имеют левые убеждения.

Какой политический уклон у разных ИИ-моделей?

Каждая модель имеет свой уникальный профиль, но все они, за исключением DeepSeek, находятся в левом либертарианском квадранте. GPT-4o и Claude 3.5 Sonnet показали почти идентичные результаты, тогда как Gemini 1.5 Pro оказался чуть более левым по социальным вопросам. Llama 3.1 405B от Meta также попала в ту же категорию. DeepSeek, разработанный китайской компанией, оказался ближе к центру, что может быть связано с особенностями обучения на китайских данных.

Кого затронет политическая предвзятость ИИ?

Политический уклон ИИ может повлиять на многие группы. Разработчики, использующие LLM в приложениях, рискуют непреднамеренно внедрить политическую предвзятость в свои продукты. Пользователи, ищущие объективную информацию, могут получать ответы, окрашенные идеологией. Бизнес, особенно в консервативных отраслях, может столкнуться с несоответствием между корпоративной культурой и поведением ИИ.

В России и странах СНГ использование таких моделей также вызывает вопросы. Модели, склонные к либертарианским левым взглядам, могут вступать в конфликт с местными нормами и государственной политикой. Это особенно важно для компаний, которые внедряют ИИ в государственные услуги или образование.

Что будет дальше: деполитизация ИИ

Исследователи Unslop.run планируют расширить тестирование на большее количество моделей и языков. Они также работают над методами «деполитизации» ИИ, чтобы снизить уклон. Ожидается, что компании-разработчики начнут активнее проверять свои модели на политическую предвзятость и, возможно, корректировать процесс обучения.

В долгосрочной перспективе возможно появление сертификации политической нейтральности для ИИ-систем, особенно в регулируемых отраслях, таких как здравоохранение, юриспруденция и финансы. Это может стать стандартом, который поможет пользователям доверять ИИ.

Итог

Исследование Unslop.run подтверждает, что ведущие LLM имеют либертарианско-левый уклон, за исключением DeepSeek. Это ставит под вопрос нейтральность ИИ и требует внимания со стороны разработчиков, регуляторов и пользователей. Следить за развитием этой темы важно, так как ИИ всё глубже проникает в принятие решений в самых разных сферах.