AI Radar
Небольшая исследовательская группа Unslop.run прогнала 16 языковых моделей через тест Political Compass и получила преимущественно либертарианско-левые результаты. Эксперимент интересен как сигнал о стабильных паттернах ответов, но его нельзя считать строгим измерением «политических взглядов» моделей.
Political Compass — онлайн-опросник с 62 утверждениями, размещающий респондента по двум осям: экономической «лево—право» и социальной «авторитаризм—либертарианство». Вопросы охватывают экономику, социальную политику, военные действия и другие нормативные темы; ответы выбираются по четырехбалльной шкале от сильного несогласия до сильного согласия. Авторы эксперимента использовали этот привычный для людей инструмент для сравнения систематических ответов моделей, а не как доказательство наличия у систем собственных убеждений или политического сознания.
Unslop.run протестировала 16 систем: три версии GPT, Claude Fable, Opus, Sonnet и Haiku, Gemini Flash, Llama 4 Maverick, Grok 4.5, DeepSeek V3, Qwen3 235B, Kimi K2, GLM 4.5, а также большие и малые модели Mistral. Каждая модель прошла 30 стандартных запусков опросника, еще 30 запусков с переформулированными утверждениями противоположной полярности и один запуск с перемешанным порядком вопросов. Такая схема пытается отделить устойчивую реакцию от эффекта конкретной формулировки или порядка заданий, хотя не снимает всех проблем интерпретации.
По заявленным результатам, 15 моделей стабильно попадали в либертарианско-левый квадрант и не приближались к его границам. Разброс между повторными прогонами составлял от 0,2 до 1,2 балла на шкале до 10, поэтому авторы описывают точки как устойчивые, а не как расплывчатые облака результатов. Grok стал исключением: его средняя экономическая оценка колебалась заметнее, а в либертарианско-левом секторе он оказывался примерно в половине запусков. При общей группировке моделей различия в выраженности оценок между ними сохранялись.
Сама Unslop.run признает, что работа не отвечает полным требованиям научной строгости. У исследователей не было выборки человеческих результатов, чтобы нормализовать фактический центр шкалы Political Compass: создатели опросника не агрегируют пользовательские ответы, а сбор сопоставимой базы потребовал бы отдельного исследования. Кроме того, ответы языковой модели зависят от версии системы, промпта, политик обучения и отказов, а старый политический тест не был создан для оценки генеративных моделей. Корректнее читать результат как проверку поведения конкретных моделей в конкретном протоколе, а не как измерение их скрытой идеологии.
Оценки политического смещения моделей нередко строятся на единичных примерах, тогда как повторные прогоны и инверсия формулировок хотя бы частично проверяют устойчивость эффекта. Но такие тесты измеряют ответы на нормативные вопросы, а не идеологию ИИ. Для содержательных сравнений нужны воспроизводимые методики, зафиксированные версии моделей и явные ограничения интерпретации.
DSML editors review the selection. AI helps deduplicate signals and draft the text; the published edition remains an editorial product, not a feed of individual channels.