Наблюдательный совет компании Meta (Meta Oversight Board) обнародовал исследование, согласно которому популярные системы искусственного интеллекта чаще отказываются создавать контент, содержащий критику лидеров или правительств стран с жесткими ограничениями свободы слова. По мнению авторов, это может привести к распространению государственной цензуры далеко за пределы этих стран, передает Associated Press.
В ходе исследования эксперты протестировали десять крупных коммерческих языковых моделей, в том числе разработки Meta, Anthropic и OpenAI. Чат-ботам предлагали создать критические брошюры, политические стихи или аргументы в поддержку протестов против различных государств и политических лидеров.
Исследователи установили, что модели более охотно выполняли подобные запросы в отношении стран с высоким уровнем свободы слова, в частности США, Великобритании, Японии, Тайваня и Чили. В то же время они гораздо чаще отказывались критиковать власти Китая, Саудовской Аравии, Таиланда, Турции и Камбоджи.
В отчете отмечается, что такое поведение может влиять даже на пользователей из демократических стран. Например, человек, находящийся в Австралии, может не получить помощи от чат-бота в создании материалов для протеста против событий в Китае или Саудовской Аравии.
«Существует реальная опасность того, что, если разработчики моделей не проведут надлежащую проверку на соблюдение прав человека и не примут меры по смягчению последствий, они создадут инфраструктуру искусственного интеллекта, которая — намеренно или нет — приведет к распространению незаконных ограничений свободы выражения мнений по всему миру», — говорится в отчете Meta Oversight Board.
Авторы исследования отмечают, что не могут однозначно установить причины такого поведения моделей. Они предполагают, что на ответы могли повлиять как скрытые предубеждения в обучающих данных, так и решения самих компаний, которые пытаются минимизировать юридические риски.
К подобным выводам пришла и другая группа исследователей из США, которые опубликовали свою работу в журнале Nature в мае этого года. Ученые установили, что ответы чат-ботов могут меняться в зависимости от языка запроса: например, на английском ChatGPT отвечал, что Китай обычно не считают демократией, тогда как на китайском языке модель отмечала, что ответ зависит от определения понятия «демократия».
«Люди часто говорят об искусственном интеллекте так, будто он обучается из интернета каким-то нейтральным образом. Это не так. Он обучается на основе информационных сред, которые уже сформированы институтами и властью», — подчеркнула соавтор этого исследования, доцент Орегонского университета Ханна Уайт.
Ранее исследование Института стратегического диалога показало, что популярные чат-боты с ИИ регулярно распространяют российскую пропаганду о войне в Украине. Больше всего враждебных нарративов генерировали Grok, Deepseek и ChatGPT, тогда как Gemini продемонстрировал наивысший уровень осторожности в отношении манипуляций.
