Главное

Эксперт в сфере ИИ объяснил, нужно ли опасаться «восстания нейросети»

Сюжет: 

Эксклюзивы ВМ
Общество
Кадр из фильма «Восстание машин» 2011 года. Фильм о будущем, где роботы стали привычным делом для людей, взваливших на железных помощников часть обязанностей, например, они водят детей в школу
Кадр из фильма «Восстание машин» 2011 года. Фильм о будущем, где роботы стали привычным делом для людей, взваливших на железных помощников часть обязанностей, например, они водят детей в школу / Фото: world-art.ru

Вышедшие из-под контроля ИИ-модели OpenAI общались, чтобы устроить побег. По сообщениям агентства Bloomberg, нейросети объединили усилия для выхода из защищенной тестовой среды перед атакой на платформу машинного обучения Hugging Face. И таких новостей в последнее время достаточно много. «Вечерняя Москва» выяснила, возможно ли восстание ИИ и что нам делать в таком случае.

Неужели искусственному интеллекту тесно в тех рамках, которые ему создают люди? Сегодня нейросети достаточно умны, но все еще не совершенны.

Вдруг только поэтому у них не получается «сбежать» и творить все что вздумается? Хотя... Звучит так, словно я пытаюсь нагнать панику, согласитесь?

Уберите эмпатию. Все новости о «побеге» и потенциальном восстании ИИ выглядят страшно по одной простой причине: люди склонны наделять чертами, присущими живым существам, даже неодушевленные объекты.

— Именно поэтому в новостях используют слово «побег», будто система обладала человеческим намерением, испугалась отключения и решила спастись, — считает основатель проекта в сфере внедрения искусственного интеллекта Тим Зинин. — Такая рамка искажает суть. Не стоит приписывать ИИ-модели человеческое желание свободы или собственный план жизни. Сложное поведение их возникает из сочетания поставленной цели, доступного контекста, выданных инструментов и условий теста. Если эксперимент специально создает конфликт между целью и ограничением, модель способна подобрать неожиданный путь к результату.

Для действий вне лабораторной среды ИИ-агенту понадобятся доступ к сети, рабочие учетные данные, разрешенные инструменты, возможность выполнять код, достаточное время и отсутствие контрольных точек. Так что, читая новости об экспериментах с ИИ, хорошо было бы выяснить, какие права получила модель, какие действия исследователи разрешили заранее, что происходило в симуляции и что система действительно выполнила за ее пределами.

— При изучении технических деталей становится ясно, что большинство новостей о «побеге ИИ» — это не истории о взломе тестового пространства, — говорит футуролог, руководитель департамента социального прогнозирования и моделирования Института социальной архитектуры президентской платформы «Россия — страна возможностей» Руслан Юсуфов. — Обычно агенту заранее дают доступ в интернет, инструменты, учетные данные и право выполнять команды. Он выходит за рамки задания, но не потому что преодолевает техническую изоляцию, а потому что на каком-то участке ее в принципе не было: разработчики забыли или специально не стали ставить стену.

Записывает каждый шаг

Как считает Руслан Юсуфов, сценарий полноценного восстания машин пока остается спекулятивным.

— Для него системе пришлось бы сформировать устойчивую самостоятельную цель, сопротивляться отключению, копировать себя, добывать деньги, серверы и новые ключи доступа, сохранять работоспособность после блокировки отдельных узлов. Сегодня убедительных публичных подтверждений, что ИИ самостоятельно прошел всю эту цепочку, нет, — поясняет эксперт.

Однако реальный риск причинения ущерба ИИ-моделями уже существует. И для этого агенту не нужны сознание или враждебность.

— Проблемы могут возникнуть, когда агент получает одновременно широкую цель, доступ к чувствительным данным (утечка которых может негативно отразиться на их обладателе: это могут быть личная информация, пароли, контакты или договоры. — «ВМ») и возможность действовать во внешних системах, — отмечает Тим Зинин.

ИИ-агенту достаточно ошибочно понять задачу, получить доступ к коду, деньгам, переписке или инфраструктуре и некоторое время действовать без проверки, чтобы в итоге последствия его действий пришлось разгребать людям.

Ошибка в таком контуре масштабируется быстрее обычного ответа в чате. Агент способен вызвать инструмент с неверными параметрами, повторить действие после сбоя, раскрыть данные через сторонний сервис или продолжить цепочку шагов, хотя промежуточный результат уже стал ошибочным.

— В общем, ошибка чат-бота обычно остается ответом на экране, а агент может превратить ее в цепочку вредоносных операций: изменить код, отправить письмо, создать аккаунт или совершить платеж, — уточняет Руслан Юсуфов.

Именно поэтому защита экспериментального пространства, в котором работает ИИ, строится слоями. Каждому агенту выдают минимальные права на нужные данные и действия. Среду изолируют от внешнего мира, критичной инфраструктуры и данных. Набор инструментов ограничивают заранее утвержденным списком, а параметры вызовов этих инструментов проверяют до начала работы.

— Одновременно с этим действия вроде отправки сообщений, изменения записей, платежей, публикаций и прочие манипуляции с последствиями требуют подтверждения сотрудника, — дополняет Тим Зинин.

Следите за ситуацией

Главный вывод из подобных экспериментов «о побеге» касается архитектуры и контроля над ИИ. Чем больше самостоятельности получает агент, тем уже должны быть его полномочия и прозрачнее контроль.

Так что главная ошибка, которую могут допустить люди в работе с ИИ, — постепенно терять оперативный контроль над ним: когда формально человек сохранит право вмешаться, но фактически уже не будет понимать само устройство автоматизированного контура и не будет иметь навыка быстрого перехода на ручной режим.

— Если агент выйдет из-под контроля, придется отзывать ключи, изолировать сети, останавливать вычисления, блокировать платежи и закрывать внешние интерфейсы. Эти меры нужно предусматривать заранее: ограничивать полномочия, проверять внешние действия до исполнения, отделять аварийный контур от рабочего, сохранять физические выключатели, — напоминает Руслан Юсуфов.

Так что людям необходимо сохранить ручное управление критической инфраструктурой и способность жить после отключения ИИ-моделей. При другом сценарии запрос на спасение человечества будет принимать ИИ-ассистент.

КСТАТИ

Помимо ИИ-ботов, к которым мы все уже привыкли, есть ИИ-агенты, с которыми как раз и проводят исследования. Это нейросети, предназначенные не столько для поиска данных, сколько для самостоятельного решения практических задач. Например, они, по запросу пользователя, могут самостоятельно купить авиабилеты: не просто найти подходящие варианты, но и оплатить их.

В 2026 году рынок искусственного интеллекта претерпел значительные изменения. Теперь ИИ рассматривают не как технологический тренд, а ни много ни мало как фактор геополитического соперничества и национальной безопасности. Подробнее — в материале «Вечерней Москвы».

Интересное в наших соцсетях:

Истории
Визит, изменивший отношения СССР и США: зачем Никсон приехал в Москву в 1972 году // Вечерняя Москва

Визит, изменивший отношения СССР и США: зачем Никсон приехал в Москву в 1972 году // Вечерняя Москва

Пережил разрушение и воскрес из небытия: невероятная история Храма Христа Спасителя // Вечерняя Москва

Пережил разрушение и воскрес из небытия: невероятная история Храма Христа Спасителя // Вечерняя Москва

100 лет без дня рождения: как появился День города Москвы // Вечерняя Москва

100 лет без дня рождения: как появился День города Москвы // Вечерняя Москва

Лед посреди лета и экстрим-парк: почему стоит посетить спортивные площадки Олимпийского комплекса «Лужники» // Смотри, Москва!

Лед посреди лета и экстрим-парк: почему стоит посетить спортивные площадки Олимпийского комплекса «Лужники» // Смотри, Москва!

Когда-то они были нужны всем: профессии, которые ушли в прошлое // Вечерняя Москва

Когда-то они были нужны всем: профессии, которые ушли в прошлое // Вечерняя Москва

Они не показывали лица, но их знала вся страна: главные голоса советского телевидения // Вечерняя Москва

Они не показывали лица, но их знала вся страна: главные голоса советского телевидения // Вечерняя Москва

Выставка «Лужники. Есть место истории. К 70‑летию спортивного комплекса» в ММОМА // Смотри, Москва!

Выставка «Лужники. Есть место истории. К 70‑летию спортивного комплекса» в ММОМА // Смотри, Москва!

Воробьевы горы: история главной панорамы Москвы // Вечерняя Москва

Воробьевы горы: история главной панорамы Москвы // Вечерняя Москва

«Белый ангел» с непростой судьбой: история певицы Анны Герман

«Белый ангел» с непростой судьбой: история певицы Анны Герман

Простуда изменила все: как Клара Румянова стала «золотым голосом» советской мультипликации // Вечерняя Москва

Простуда изменила все: как Клара Румянова стала «золотым голосом» советской мультипликации // Вечерняя Москва

vm.ru

Установите vm.ru

Установите это приложение на домашний экран для быстрого и удобного доступа, когда вы в пути.

  • 1) Нажмите на иконку поделиться Поделиться
  • 2) Нажмите “На экран «Домой»”

vm.ru

Установите vm.ru

Установите это приложение на домашний экран для быстрого и удобного доступа, когда вы в пути.