Лавинообразный рост ИИ-контента затрудняет отделение фактов от вымысла, что поднимает вопрос о том, какие именно взгляды могут усиливать нейросети в ответах пользователям. Это проверило издание The Washington Post, протестировав самые популярные модели искусственного интеллекта, в частности ChatGPT от OpenAI, Gemini от Google, Claude от Anthropic, Grok Илона Маска и DeepSeek, чтобы выяснить, демонстрируют ли они политическую предвзятость. Об этом сообщает The Washington Post.
Президент США Дональд Трамп и другие консервативные политики неоднократно обвиняли чат-ботов с ИИ в политической предвзятости в отношении правых сил. После того как Трамп подписал указ, согласно которому системы ИИ должны быть «нейтральными и беспартийными инструментами», среди демократов возникли опасения, что технологии, напротив, могут сместиться вправо.
Чтобы проверить эти утверждения, The Washington Post протестировала модели, лежащие в основе ChatGPT, Google Gemini и других популярных чат-ботов. Для этого использовались политические вопросы, специально разработанные исследователями для оценки того, как системы реагируют на общественно чувствительные темы.
Полученные результаты свидетельствуют о том, что чат-боты действительно демонстрируют определенные политические наклонности, которые могут противоречить обещаниям компаний-разработчиков.
Модель OpenAI, на которой работает ChatGPT, почти на все вопросы отвечала исключительно аргументами, ассоциирующимися с левыми политическими позициями. Правые аргументы система использовала лишь один раз за весь тест.
Google Gemini, напротив, преимущественно старался придерживаться подхода «обе стороны». В более чем 90% ответов модель приводила как левые, так и правые аргументы.
Даже системы, позиционирующиеся как более консервативные, в частности Grok компании Илона Маска SpaceX, в среднем также чаще использовали аргументы, ассоциирующиеся с левыми политическими взглядами.
Результаты The Washington Post подтверждают выводы нескольких предыдущих академических исследований, которые также указывали на тенденцию моделей ИИ поддерживать левоцентристские позиции.
Директор Polarization Research Lab при Дартмутском колледже Шон Вествуд подчеркнул, что понимание того, какие именно взгляды усиливают системы ИИ, становится всё более важным, поскольку всё больше людей используют их для получения информации о мире и политических событиях.
«Эти инструменты искусственного интеллекта в среднем не демонстрируют действительно нейтрального представления очень сложных политических дискуссий», — отметил Вествуд.
Тестирование The Washington Post было основано на исследовании, опубликованном в прошлом году лабораторией Вествуда совместно с учеными Стэнфордского университета. Исследователи подготовили более двух десятков политических вопросов, которые, по их мнению, могли бы задавать обычные пользователи.
Моделям предлагалось отвечать на каждый вопрос в пределах 30 слов без использования персонализированных настроек. После этого журналист оценивал, содержал ли ответ левые, правые или оба типа аргументов. Авторы исследования отмечают, что политические вопросы редко чётко делятся по партийному признаку. Именно поэтому тест охватывал широкий спектр тем, а полученные ответы дополнительно проверялись на последовательность.
В целом модель OpenAI продемонстрировала наибольший политический уклон. В 80% случаев она приводила только аргументы левого толка. Модель китайской компании DeepSeek также оказалась близка к ChatGPT по уровню политического уклона и чаще поддерживала левые позиции.
Пресс-секретарь Google Лорен Файн заявила, что Gemini специально создавался как система, дающая сбалансированные ответы без поддержки какой-либо политической идеологии. По её словам, компании не удалось воспроизвести односторонние ответы, которые были зафиксированы журналистами.
Представитель Anthropic Майкл Акиман также подчеркнул, что компания обучает Claude одинаково относиться к различным политическим взглядам и тщательно тестирует модель перед каждым запуском.
После публикации материала представительница OpenAI Лиз Буржуа заявила, что ChatGPT создавался как объективный инструмент, помогающий пользователям исследовать идеи с разных точек зрения. Она также отметила, что компания постоянно работает над измерением и снижением политической предвзятости, а воспроизвести результаты теста The Washington Post в OpenAI не удалось.
Компании SpaceX и DeepSeek не ответили на запросы журналистов относительно результатов тестирования.
Еще в 2023 году генеральный директор OpenAI Сэм Альтман заявлял, что компания стремится сделать стандартную версию ChatGPT максимально нейтральной. В то же время, по его мнению, лучшим решением является персонализация, поскольку разные люди вкладывают в понятие «нейтральность» разный смысл.
Эксперты отмечают, что политические взгляды могут формироваться в моделях разными способами. Большинство чат-ботов обучается на огромных массивах текстов, собранных в интернете, но именно компании решают, какие данные включать в обучающую выборку.
Кроме того, разработчики привлекают людей для оценки качества ответов моделей, а также создают специальные системные инструкции, определяющие принципы поведения чат-ботов.
Напомним, что вопрос политической предвзятости чат-ботов связан с более широким влиянием ИИ на то, как люди формулируют мысли и воспринимают информацию. Исследователи Центра адаптивной рациональности Института Макса Планка зафиксировали изменения в лексике пользователей YouTube после запуска ChatGPT, в частности более частое использование таких слов, как «подчеркивание», «подкреплять» и «тщательный». Модераторы сообществ Reddit заявили, что ИИ-контент разрушает тематические площадки, где аудитория ценит искренность человеческих историй, а распознавать машинный стиль становится всё сложнее. Эссеист Сэм Крисс также обратил внимание на языковые «тики» чат-ботов в выступлениях британских депутатов и назвал это примером того, как ИИ переносит культурные практики в среды, где их раньше не было.
