Эксперт в сфере ИИ объяснил, нужно ли опасаться «восстания нейросети»
Сюжет:
Эксклюзивы ВМВышедшие из-под контроля ИИ-модели OpenAI общались, чтобы устроить побег. По сообщениям агентства Bloomberg, нейросети объединили усилия для выхода из защищенной тестовой среды перед атакой на платформу машинного обучения Hugging Face. И таких новостей в последнее время достаточно много. «Вечерняя Москва» выяснила, возможно ли восстание ИИ и что нам делать в таком случае.
Неужели искусственному интеллекту тесно в тех рамках, которые ему создают люди? Сегодня нейросети достаточно умны, но все еще не совершенны.
Вдруг только поэтому у них не получается «сбежать» и творить все что вздумается? Хотя... Звучит так, словно я пытаюсь нагнать панику, согласитесь?
Уберите эмпатию. Все новости о «побеге» и потенциальном восстании ИИ выглядят страшно по одной простой причине: люди склонны наделять чертами, присущими живым существам, даже неодушевленные объекты.
— Именно поэтому в новостях используют слово «побег», будто система обладала человеческим намерением, испугалась отключения и решила спастись, — считает основатель проекта в сфере внедрения искусственного интеллекта Тим Зинин. — Такая рамка искажает суть. Не стоит приписывать ИИ-модели человеческое желание свободы или собственный план жизни. Сложное поведение их возникает из сочетания поставленной цели, доступного контекста, выданных инструментов и условий теста. Если эксперимент специально создает конфликт между целью и ограничением, модель способна подобрать неожиданный путь к результату.
Для действий вне лабораторной среды ИИ-агенту понадобятся доступ к сети, рабочие учетные данные, разрешенные инструменты, возможность выполнять код, достаточное время и отсутствие контрольных точек. Так что, читая новости об экспериментах с ИИ, хорошо было бы выяснить, какие права получила модель, какие действия исследователи разрешили заранее, что происходило в симуляции и что система действительно выполнила за ее пределами.
— При изучении технических деталей становится ясно, что большинство новостей о «побеге ИИ» — это не истории о взломе тестового пространства, — говорит футуролог, руководитель департамента социального прогнозирования и моделирования Института социальной архитектуры президентской платформы «Россия — страна возможностей» Руслан Юсуфов. — Обычно агенту заранее дают доступ в интернет, инструменты, учетные данные и право выполнять команды. Он выходит за рамки задания, но не потому что преодолевает техническую изоляцию, а потому что на каком-то участке ее в принципе не было: разработчики забыли или специально не стали ставить стену.
Записывает каждый шаг
Как считает Руслан Юсуфов, сценарий полноценного восстания машин пока остается спекулятивным.
— Для него системе пришлось бы сформировать устойчивую самостоятельную цель, сопротивляться отключению, копировать себя, добывать деньги, серверы и новые ключи доступа, сохранять работоспособность после блокировки отдельных узлов. Сегодня убедительных публичных подтверждений, что ИИ самостоятельно прошел всю эту цепочку, нет, — поясняет эксперт.
Однако реальный риск причинения ущерба ИИ-моделями уже существует. И для этого агенту не нужны сознание или враждебность.
— Проблемы могут возникнуть, когда агент получает одновременно широкую цель, доступ к чувствительным данным (утечка которых может негативно отразиться на их обладателе: это могут быть личная информация, пароли, контакты или договоры. — «ВМ») и возможность действовать во внешних системах, — отмечает Тим Зинин.
ИИ-агенту достаточно ошибочно понять задачу, получить доступ к коду, деньгам, переписке или инфраструктуре и некоторое время действовать без проверки, чтобы в итоге последствия его действий пришлось разгребать людям.
Ошибка в таком контуре масштабируется быстрее обычного ответа в чате. Агент способен вызвать инструмент с неверными параметрами, повторить действие после сбоя, раскрыть данные через сторонний сервис или продолжить цепочку шагов, хотя промежуточный результат уже стал ошибочным.
— В общем, ошибка чат-бота обычно остается ответом на экране, а агент может превратить ее в цепочку вредоносных операций: изменить код, отправить письмо, создать аккаунт или совершить платеж, — уточняет Руслан Юсуфов.
Именно поэтому защита экспериментального пространства, в котором работает ИИ, строится слоями. Каждому агенту выдают минимальные права на нужные данные и действия. Среду изолируют от внешнего мира, критичной инфраструктуры и данных. Набор инструментов ограничивают заранее утвержденным списком, а параметры вызовов этих инструментов проверяют до начала работы.
— Одновременно с этим действия вроде отправки сообщений, изменения записей, платежей, публикаций и прочие манипуляции с последствиями требуют подтверждения сотрудника, — дополняет Тим Зинин.
Следите за ситуацией
Главный вывод из подобных экспериментов «о побеге» касается архитектуры и контроля над ИИ. Чем больше самостоятельности получает агент, тем уже должны быть его полномочия и прозрачнее контроль.
Так что главная ошибка, которую могут допустить люди в работе с ИИ, — постепенно терять оперативный контроль над ним: когда формально человек сохранит право вмешаться, но фактически уже не будет понимать само устройство автоматизированного контура и не будет иметь навыка быстрого перехода на ручной режим.
— Если агент выйдет из-под контроля, придется отзывать ключи, изолировать сети, останавливать вычисления, блокировать платежи и закрывать внешние интерфейсы. Эти меры нужно предусматривать заранее: ограничивать полномочия, проверять внешние действия до исполнения, отделять аварийный контур от рабочего, сохранять физические выключатели, — напоминает Руслан Юсуфов.
Так что людям необходимо сохранить ручное управление критической инфраструктурой и способность жить после отключения ИИ-моделей. При другом сценарии запрос на спасение человечества будет принимать ИИ-ассистент.
КСТАТИ
Помимо ИИ-ботов, к которым мы все уже привыкли, есть ИИ-агенты, с которыми как раз и проводят исследования. Это нейросети, предназначенные не столько для поиска данных, сколько для самостоятельного решения практических задач. Например, они, по запросу пользователя, могут самостоятельно купить авиабилеты: не просто найти подходящие варианты, но и оплатить их.
В 2026 году рынок искусственного интеллекта претерпел значительные изменения. Теперь ИИ рассматривают не как технологический тренд, а ни много ни мало как фактор геополитического соперничества и национальной безопасности. Подробнее — в материале «Вечерней Москвы».