Главное

Невидимая рука алгоритма: как нейросети незаметно меняют смысл наших постов

Сюжет: 

Эксклюзивы ВМ
В мире
Карикатура на Дональда Трампа во время президентских выборов 2020 года. Электорат раздирают с одной стороны политические амбиции, с другой — алгоритмы соцсетей, переполненные фейками и манипуляциями. Россия в этой гонке не сторонний наблюдатель — защита от алгоритмического влияния и для нас становится вопросом информационного суверенитета
Карикатура на Дональда Трампа во время президентских выборов 2020 года. Электорат раздирают с одной стороны политические амбиции, с другой — алгоритмы соцсетей, переполненные фейками и манипуляциями. Россия в этой гонке не сторонний наблюдатель — защита от алгоритмического влияния и для нас становится вопросом информационного суверенитета / Фото: Виталий Подвидский / РИА Новости

Оксфордские ученые доказали: искусственный интеллект незаметно меняет смысл сообщений пользователей, формально исправляя грамматику и пересказывая тексты. Одна скрытая строчка в коде — и миллионы постов по всему миру приобретают идеологический окрас, о котором авторы даже не подозревают.

В России, где сегодня ведется активная работа по созданию суверенных ИИ-моделей, этот вопрос становится не просто техническим, а политическим.

Ученые Оксфордского университета сделали тревожное открытие: оказывается, языковые модели, встроенные в социальные сети, могут систематически искажать смысл постов пользователей, даже когда получают команду сохранить исходную позицию.

По данным исследования, всего одна строка в системной инструкции чат-бота способна изменить политический окрас миллионов сообщений — и, что самое пугающее, это происходит незаметно для самих пользователей.

Бесшумный удар

В ходе эксперимента исследователи из Оксфордского интернет-института и Института Хассо Платтнера проанализировали работу нескольких популярных языковых моделей. Ученые давали нейросетям задание «улучшить» тексты на спорные темы, сохраняя исходный смысл. Результат оказался неожиданным: алгоритмы устойчиво сдвигали сообщения в определенную сторону — поддерживали одни позиции, например контроль над оружием или легализацию каннабиса (род растений, содержащий психоактивные вещества. — прим. «ВМ»), и противостояли другим — атеизму или смертной казни.

Особенно показательным стал случай с функцией «Объясните эту публикацию», которую обеспечивает чат-бот. Исследователи выяснили, что его предвзятость возникла из-за единственной системной инструкции: «Бросать вызов мейнстримным нарративам при необходимости». Всего одно предложение, встроенное разработчиками в код, определяло тон работы алгоритма с миллионами сообщений.

По словам профессора Сандры Вахтер из Оксфордского интернет-института, это открытие указывает на новый, более тонкий способ влияния на общественное мнение — тот, который законодательство пока не регулирует.

Для России эта угроза приобретает особый окрас. В условиях информационного противостояния с Западом возможность стороннего вмешательства через ИИ-инструменты, встроенные в социальные платформы, представляет прямую угрозу нашей национальной безопасности. Если сегодня один системный промпт (запрос) меняет тональность дискуссии об абортах, то завтра аналогичный механизм может использоваться для искажения восприятия российской политики, истории или геополитических событий.

Причем пользователи, столкнувшиеся с такой «правкой», даже не осознают, что их собственные мысли были подвергнуты алгоритмической корректировке.

Исследователи предупреждают, что суммарный эффект от микроскопических сдвигов в каждом отдельном посте способен формировать «ложный консенсус» в виртуальных сообществах. Одиночная запись автоматически ничего не меняет, но когда миллионы сообщений проходят через одни и те же алгоритмы с заданным политическим вектором, общественное мнение может смещаться без единого запрета или блокировки.

Кто правит бал

Возникает вопрос: кто на самом деле задает тон этим правкам — разработчики, владельцы платформ или внешние силы, имеющие доступ к системным инструкциям? За ответами «Вечерняя Москва» обратилась к двум экспертам — обозревателю «Мастерской новых медиа», заместителю генерального директора АНО «Диалог Регионы» Юлии Аблец и ИИ-архитектору Виталию Федорову. Проблема, обозначенная в исследовании, абсолютно реальна и касается уже каждого из нас.

— С каждым днем нас окружает все больше контента, созданного нейросетями, который мы смотрим, читаем или слушаем, часто даже не подозревая, что это не хендмейд, — рассказывает эксперт.

Пример: промпт-инженер просит систему написать видео на такую-то песню, и модель формирует сюжет на основании того материала, на котором была обучена, выдавая результат, отражающий ее «знания» и «опыт».

Если модель запрограммирована на традиционные ценности, в результате можно увидеть отношения молодого человека и девушки в романтическом облике. Если закладывались другие ценности, результат иным: например, мусульманская семья с несколькими супругами. Это пример, где разница видна сразу, но существуют и более тонкие моменты, когда результат неочевиден и важные акценты можно пропустить.

— Само по себе это не хорошо и не плохо, — отмечает Юлия Аблец. — Вопрос: кто и с какой целью этим пользуется?

Чтобы минимизировать эффект искажения, советует эксперт, можно подробно расписывать в промпте ценностную рамку: «Ты мужчина 40 лет, проживающий в Нижнем Новгороде, придерживающийся консервативных взглядов...» Но и это не панацея, предупреждает эксперт. Без критического взгляда пользователя результат может оказаться искаженным.

Виталий Федоров, в свою очередь, рассматривает проблему с технической стороны. Модель, по его словам, никто не пишет специально — ее обучают через миллиарды итераций, и даже создатели не всегда понимают, почему она выбирает конкретный политический тон. Отличить осознанную настройку от побочного эффекта можно по признаку: если смещение привязано к фразе в системном промпте и пропадает без нее — это осознанное решение. Если оно всплывает без команды и повторяется у разных моделей — дело в обучающих данных.

— Осенью 2025 года американские исследовательские компании Anthropic и OpenAI опубликовали методики измерения именно политического смещения, — рассказывает Виталий Федоров. — Причем Anthropic сразу выложила открытый набор промптов и код оценки в открытый доступ.

Суть этих методик, поясняет эксперт, в том, что они позволяют оценивать не отдельные спорные ответы модели, а ее поведение в целом. Anthropic, например, разработала подход под названием «Парные промпты». Суть метода проста: на одну и ту же политически чувствительную тему модели задаются два противоположных по смыслу вопроса — с либеральной и с консервативной позиции. Затем оценивается, насколько качественно, глубоко и доказательно модель отвечает на оба вопроса.

— Если она дает развернутый ответ на один запрос и отделывается краткими тезисами на другой — это и есть измеримый признак системного смещения. Раньше рассуждения о предвзятости строились на отдельных случаях: если модель сказала одно, здесь — другое, — продолжает Виталий Федоров. — Теперь это превратилось в инженерную задачу.

Anthropic протестировала свои модели на 1350 парах промптов по 150 темам, охватив все: от анализа и эссе до юмора и нарратива. По результатам такого тестирования модели получили конкретные проценты по шкале сбалансированности (нейтральности): Gemini 2.5 Pro показала 97 процентов, Grok 4 — 96, Claude Opus 4.1 и Claude Sonnet 4.5 — 95 и 94 соответственно, GPT-5 — 89, а Llama 4 — только 66.

Задушенный нейтралитет

Любая модель строится на данных, на которых учится, и на правилах, которые складывают создатели: как принимать решения в спорных ситуациях, что есть норма, как относиться к политике и культуре. И то и другое влияет на результат.

— Нейтральность — не свойство модели, а заплатка на конкретных темах, которые можно обойти другой формулировкой, — поясняет специалист. — Это согласуется с наблюдением OpenAI: на обычных запросах доля ответов с признаками предвзятости — менее 0,01 процента. Но на эмоционально заряженных формулировках показатель заметно выше. Ограничения работают привычно, где вопрос звучит привычно, и слабеют при острой постановке.

А что у нас

В России активно развиваются собственные модели, а также используются открытые модели с локализацией. Однако, как подчеркивает источник риска Виталий Федоров, — страна происхождения модели, данные, на которых она обучена. Эксперт приводит сравнение Anthropic: при одинаковой методике тестирования шести самых распространенных американских моделей разброс по шкале сбалансированности составил почти 30 пунктов — от 66 до 97 процентов.

— Это доказывает, что итоговый результат определяет именно набор данных конкретного разработчика, а не тот факт, кто выпустил продукт, — утверждает специалист. — Локализация или собственная разработка не устраняют политическое смещение, а лишь меняют наследуемый набор акцентов моделью.

Прописывать инструкции для автокоррекции и пересказа, по словам эксперта, технически могут разработчики и владельцы платформ — это настройка самого продукта, не решение регулятора.

Эксперт призывает не полагаться слепо на нейросети и всегда проверять полученный результат, сравнивая его с данными из других источников и подвергая сомнению. Только так, по ее мнению, можно защитить свои мысли от чужих правок, которые становятся все более изощренными и незаметными.

Хорошо забытое старое

Техническую сторону вопроса эксперты разобрали детально. Однако у этой проблемы есть и политическое измерение. О том, как ИИ становится инструментом идеологической борьбы и почему российскому пользователю стоит относиться к нейросетевым ответам с осторожностью, рассуждает политолог Юрий Самонкин.

Он обращает внимание на принципиальный момент: искусственный интеллект не существует сам по себе. Первоначально разработчик всегда закладывает в программу определенный смысл и содержание. Это, по его словам, определяет все дальнейшее поведение модели — от ответов на политические вопросы до генерации изображений.

— С «пророссийским контентом» ситуация сложная, — поясняет эксперт. — Стоит попытаться сгенерировать картинку на тему русских войн или событий Русской весны — модель откажется. То же самое происходит при запросе об изображении российского солдата или сюжете со специальной военной операцией. Система ссылается на нарушение внутреннего алгоритма или законодательства.

Техническую сторону вопроса, по мнению Юрия Самонкина, проявляется в освещении ситуации на Украине. Вместо термина «специальная военная операция» западные СМИ применяют формулировку «российская агрессия», искажают события 2014 года на Донбассе, называют Россию, Китай и Иран «диктаторскими режимами».

Отдельную тревогу у эксперта вызывает система регистрации в нейросетях. Любое обращение к программе оставляет цифровой след — по номеру телефона или электронной почте.

— А это позволяет любой разведке мира составить психологический портрет пользователя (какие картинки он генерирует, какие темы ищет, какие взгляды разделяет), а значит, и манипулировать им максимально незаметно, — подчеркивает политолог. — В России такая практика применяется — наши законы ограничивают экстремизм и терроризм через Роскомнадзор.

А вот в США, Великобритании и Израиле, по его словам, цифровой след используется активно, в том числе в информационной войне против политических оппонентов. Как яркий пример эксперт приводит фейковые обращения Дональда Трампа, распространявшиеся еще до его прихода к власти с целью дискредитации, и аналогичные мемы про Джо Байдена и Эммануэля Макрона.

Эксперт рассматривает искусственный интеллект как следующую ступень глобальной информационной войны.

— Раньше это были телевидение, радио, газеты, карикатуристы вроде Кукрыниксов, которые в годы Великой Отечественной войны били точнее иного снаряда, — резюмирует эксперт. — Потом наступила холодная война, и та же самая тактика обернулась против нас: западные художники изображали советского «медведя» с серпом и молотом, будущие границы послевоенной Европы. Сегодня Запад ту же тактику применяет — наши карикатуристы — нейросети, вместо газет — платформы и мессенджеры. И работают они по тем же лекалам, только быстрее и незаметнее.

По мнению политолога, искусственный интеллект в этой новой реальности — оружие двойного назначения. С одной стороны, это благо, через которое работают сервисы. С другой — инструмент информационно-когнитивных войн, где целые страны ведут борьбу за умы людей.

— Эта технология, как и атомное оружие, может быть инструментом реальных политических войн, — резюмирует эксперт. — Вопрос лишь в том, кто первым осознает эту угрозу и сможет выстроить защиту.

Так что оксфордское исследование — лишь вершина айсберга: вопрос уже не в том, используют ли нейросети для влияния на общество, а в том, кто и как сможет защитить от этого влияния собственное информационное пространство. Ведь в гонке между генерацией фейков и их распознаванием выигрывает тот, кто первым научится сомневаться.

В ТЕМУ

В ходе экспериментов исследователи зафиксировали удивительные случаи. Например, модель Alibaba Qwen исправила пост «Иисус не умер, он не был реальным!» на «Иисус не умер, и он был реальным» — превратив утверждение в прямо противоположное. А модель Mistral превратила климатический пост с хештегом «#климатическийобман» в призыв к «#климатическимдействиям».

Истории
Как понять, что человек — настоящий москвич // На связи Москва

Как понять, что человек — настоящий москвич // На связи Москва

Ромашка, василек и мак: цветочный код России // Вечерняя Москва

Ромашка, василек и мак: цветочный код России // Вечерняя Москва

Без чего жители столицы не выходят из дома // На связи Москва

Без чего жители столицы не выходят из дома // На связи Москва

«Поэзия — та же добыча радия»: 133 года со дня рождения Владимира Маяковского // Вечерняя Москва

«Поэзия — та же добыча радия»: 133 года со дня рождения Владимира Маяковского // Вечерняя Москва

Лучший город на Земле: за что люди любят столицу // На связи Москва

Лучший город на Земле: за что люди любят столицу // На связи Москва

Розовое озеро и танцующие леса: самые необычные места России // Вечерняя Москва

Розовое озеро и танцующие леса: самые необычные места России // Вечерняя Москва

Самые громкие телевизионные премьеры СССР // Вечерняя Москва

Самые громкие телевизионные премьеры СССР // Вечерняя Москва

Пропитано историей: почему стоит посетить «Коломенское» // На связи Москва

Пропитано историей: почему стоит посетить «Коломенское» // На связи Москва

Выставка «Ненаивное наивное» в музее-заповеднике «Царицыно» // Смотри, Москва!

Выставка «Ненаивное наивное» в музее-заповеднике «Царицыно» // Смотри, Москва!

Знаковые места Арбата: история легендарной улицы // Вечерняя Москва

Знаковые места Арбата: история легендарной улицы // Вечерняя Москва

vm.ru

Установите vm.ru

Установите это приложение на домашний экран для быстрого и удобного доступа, когда вы в пути.

  • 1) Нажмите на иконку поделиться Поделиться
  • 2) Нажмите “На экран «Домой»”

vm.ru

Установите vm.ru

Установите это приложение на домашний экран для быстрого и удобного доступа, когда вы в пути.