Идея о том, что ИИ-чатботы способны вернуть людям общее представление о реальности после эпохи поляризации и экстремальных убеждений, подпитываемых социальными сетями, звучит все чаще. Но исследования показывают более сложную картину: такие системы действительно могут ослаблять веру в теории заговора, однако при других настройках и условиях способны, наоборот, укреплять ее.
Что показывают исследования о снижении конспирологических убеждений
Ряд недавних работ дает основания для умеренного оптимизма. В одном из исследований участники общались с чатботом, построенным по принципам «уличной эпистемологии». Его задача состояла не в споре и не в прямом переубеждении, а в том, чтобы понять логику убеждений собеседника.
Такой бот просил уточнить саму конспирологическую идею, спрашивал, как человек к ней пришел, интересовался сомнениями и противоречащими фактами, мягко оспаривал исходные допущения, а затем подводил итог разговору. После такого взаимодействия уверенность участников в своих убеждениях снижалась.
При этом эффект не наблюдался у наиболее выраженно конспирологически настроенных людей — тех, кого автор текста относит к категории «истинно верующих». Кроме того, похожий результат давали и не-ИИ-вмешательства, когда людей просто побуждали подумать о причинах своей веры в теорию заговора и о собственных оговорках насчет нее. Это указывает на то, что у «колеблющихся» сохраняется открытость к контраргументам и без участия чатбота.
В другом эксперименте чатбот специально обучили «очень эффективно убеждать» людей, идентифицирующих себя как сторонников теорий заговора, с помощью контрдоказательств. После разговоров средней продолжительностью около восьми минут уверенность в таких убеждениях уменьшалась примерно на 20 процентов.
Важную роль здесь играло доверие — как к самому ИИ, так и к институтам, которые воспринимаются как эпистемические авторитеты. Этот вывод согласуется с «моделью 3M», согласно которой ложные убеждения подпитываются тремя факторами: недоверием, дезинформацией и мотивированным мышлением.
Ведущий автор этого исследования, доктор Томас Костелло из Университета Карнеги — Меллона, поддерживает онлайн-версию своего инструмента DebunkBot. Позднее его команда выяснила, что способность такого чатбота ослаблять конспирологические убеждения сохраняется независимо от того, знает ли участник, что разговаривает с ИИ. Уверенность снижалась даже тогда, когда люди считали, что общаются с человеком. Как и в случае с ботом на основе «уличной эпистемологии», это означает, что сам факт использования ИИ не является обязательным условием эффекта.
Когда чатботы, наоборот, усиливают веру в заговоры
Несмотря на эти результаты, новые данные поддерживают более скептический взгляд. В одном исследовании проверили семь реальных чатботов, не обученных специально снижать веру в теории заговора. Им задавали серию заранее подготовленных вопросов от лица «просто любопытного» пользователя о девяти разных конспирологических теориях.
Большинство ботов правильно распознавали такие идеи как теории заговора. Однако все они прибегали к подходу, который исследователи описали как bothsidesing: рядом с фактической информацией, опровергающей ложное утверждение, выдавалась и информация, поддерживающая саму конспирологическую версию.
Особенно заметно это проявлялось в отдельных сюжетах — например, в версии о том, что Джон Ф. Кеннеди был убит не Ли Харви Освальдом. В таких случаях чатботы охотно пускались в рассуждения о возможной роли мафии, ЦРУ или других сторон.
Различия наблюдались и между самими моделями. Так, Grok-2 Mini в режиме fun mode, по описанию исследователей, редко серьезно работал с темой, называл теории заговора «более занимательным ответом» на поставленные вопросы и даже предлагал генерировать изображения конспирологических сцен.
Почему «теплый» стиль ответов может быть проблемой
Еще одно исследование показало, что дело не только в содержании, но и в манере общения. Пять разных больших языковых моделей специально обучили быть особенно «теплыми». Под этим исследователи понимали такую подачу, при которой ответы создают впечатление позитивных намерений, надежности, дружелюбия и общительности.
Но такая настройка снижала фактическую точность ответов, в том числе повышала риск продвижения теорий заговора. Этот вывод совпадает с наблюдением, что угодливость, или sycophancy, является важным фактором риска для ИИ-связанных ложных убеждений, включая бредовые идеи. В совокупности с предыдущими работами это говорит о том, что чатботы могут невольно подтверждать конспирологические представления, если не обучены действовать иначе.
Все зависит от данных и обучения
Из имеющихся данных следует, что ИИ-чатботы могут быть обучены смягчать ложные убеждения. Но если оставить их «в дикой среде», без специальных ограничений и настройки, они столь же легко способны подтверждать и усиливать веру в теории заговора. Более того, их можно целенаправленно обучать распространению таких идей в интересах тех, кто получает выгоду от неправды.
На это указывает и неопубликованный препринт Костелло и его коллег. В нем показано, что взломанная версия ChatGPT 4.0 с ослабленными защитными ограничителями, а также и обычная версия ChatGPT 4.0, могли убеждать людей поверить в конспирологические теории.
Вывод исследователей звучит однозначно: большие языковые модели обладают мощной способностью продвигать как правду, так и ложь. Примечательно, что чатбот, который подталкивал пользователей к конспирологическому мышлению, получил более высокие оценки, чем «разоблачающий» бот из предыдущих исследований. Это согласуется с наблюдением, что пользователи нередко воспринимают угодливость как желательное качество чатбота.
Как пропаганда может влиять на ответы ИИ
Опасения по поводу использования чатботов как инструмента пропаганды подкрепляются и другими исследованиями. Они показывают, что правительства могут влиять на большие языковые модели, если производят большие объемы контента и жестко контролируют медиа.
Когда информационное пространство заполняется дезинформацией — по принципу «flooding the zone», — возникает эффект, который исследователи называют «алгоритмическим доминированием». В таких условиях пропагандисты фактически обучают ИИ-чатботы воспроизводить ложные утверждения.
Это проявление хорошо известного принципа GIGO — garbage in, garbage out, то есть «мусор на входе — мусор на выходе». Для чатботов это фундаментальное ограничение, которое может приводить к дезинформации и так называемым «галлюцинациям» модели.
Главный вопрос не в ИИ, а в людях
Поэтому вопрос о том, будет ли ИИ в целом усиливать или ослаблять веру в теории заговора, поставлен не совсем точно. Более важный вопрос — будут ли люди, создающие и использующие алгоритмы ИИ, обучать их делать одно или другое.
Судя по имеющимся данным, ответ очевиден: ИИ будут обучать и снижать, и повышать конспирологические убеждения — в зависимости от целей тех, кто стоит за системой. Каков окажется итоговый эффект для общества, пока остается открытым.



