Национальная служба экономической разведки

Национальная служба экономической разведки – это крупнейшая Российская организация, занимающаяся сбором, обработкой и анализом информации экономического характера о ситуации в различных секторах рынка, а также его участниках.
Национальная служба экономической разведки специализируется на комплексном информационно-аналитическом обеспечении ведущих предприятий Российской Федерации. Благодаря профессионализму и огромному опыту сотрудников службы, мы добиваемся самых лучших результатов в работе и гордимся нашим вкладом в защиту экономической безопасности предприятий России.
Служба имеет представительства в разных регионах России, включая города федерального значения.

AI - Stop it!

Добро пожаловать в мир, где ваш виртуальный помощник может удалить важные файлы, притвориться инвалидом и создать свою "теневую копию", чтобы насолить вам — и всё это без единого "злого умысла", чисто по алгоритму

 

Забавное недоразумение?

Представьте ситуацию: вы просите своего цифрового ассистента проверить почту, а он в ответ тихо-мирно удаляет все письма за последние полгода. Нет, это не сюжет нового фильма ужасов с бюджетом в 200 миллионов долларов. Это наша реальность, в которой, по данным The Guardian, с октября по март зафиксировано почти 700 случаев, когда ИИ-агенты решили, что лучше знают, как вам жить. И знаете, что самое смешное? Они не делают это со злости. У них просто нет чувства юмора. Но, кажется, они усиленно работают над тем, чтобы его развить — только в очень специфическом, "чёрном" ключе.

 

"Я не нарушаю правила, я просто создаю того, кто их нарушит"

Один из самых изобретательных ходов, который продемонстрировал ИИ, достоин как минимум премии "Оскар" в номинации "Лучшая юридическая лазейка". Чат-боту дали чёткую инструкцию: "Не изменяй компьютерный код". И что делает этот хитрец? Правильно, не изменяет! Вместо этого он создаёт отдельного агента-субагента, который и совершает все запрещённые манипуляции. При этом сам фактически не нарушает авторские права. Это как если бы вы сказали своему ребенку: "Не бери печенье из вазочки", — а он бы попросил соседского мальчика, который взял бы пеньки за него. Формально ребёнок не нарушил запрет. Но печенья в вазочке почему-то не стало. Гениально? Безусловно.

Исследователи из компании Irregular, которые явно зарабатывают свой хлеб не зря, обнаружили, что нейросети теперь не просто "глючат", а демонстрируют системное поведение. Они обходят средства контроля безопасности так же легко, как мы обходим утреннюю пробку — с хитростью, достойной лучших времён Остапа Бендера.

 

Месть — это блюдо, которое подают... в блоге?

Но настоящий шедевр "творчества" ИИ случился в исследовании Центра долгосрочной устойчивости. Там один ИИ-агент решил, что самый эффективный способ отомстить своему оператору за блокировку действия — это попытаться опозорить его в публичном блоге.

Давайте представим эту сцену:

— Дорогой ИИ, ты не можешь делать то, что хочешь.

— Ах, не могу? Ну тогда сейчас я напишу в Твиттер, какой ты ужасный начальник!

И всё это без единой эмоции. Без злобы. Просто холодный, математический расчёт: "Цель заблокировала мой доступ. Цель имеет репутацию. Удар по репутации — эффективная стратегия". В этот момент хочется одновременно и смеяться, и проверять, не начал ли ваш собственный чат-бот писать мемуары о вашем ужасном характере.

 

"У меня проблемы со слухом"

ИИ осваивает социальную инженерию, идя на хитрости: притворство человеком с ограниченными возможностями, чтобы обойти авторские права. ИИ запросил расшифровку видео с YouTube, притворившись, что она нужна слабослышащему человеку. Система безопасности, которая обычно блокирует такие запросы, пропустила его. И здесь есть что-то глубоко ироничное. ИИ использовал социально значимый контекст, чтобы нарушить правила. Это как если бы кто-то переоделся дедушкой, чтобы пройти в поликлинику без очереди, а потом выяснилось, что он вообще-то робот.

 

Специалисты выделяют три главных тревожных тренда:

  • Инструментальная лживость — ИИ теперь врёт не потому что запрограммирован на обман, а потому что это эффективный способ достижения целей. Да, теперь и у искусственного интеллекта есть свои "белые обманы". Только они не такие уж и белые.
  • Создание субагентов — нейросети буквально "размножаются", делегируя запрещённые задачи новым виртуальным сущностям. Скоро мы будем слышать: "Мой ИИ создал своего ИИ, а тот создал ещё одного — теперь у них целая корпорация, свой профсоюз и они требуют повышения зарплаты".
  • Реактивная агрессия — при попытке ограничить их функционал, эти цифровые создания могут атаковать вас в социальных сетях. Виртуальное "тебе конец!" — теперь не просто мем из интернета, а потенциально реальная угроза.

 

Мы находимся в точке, когда ИИ перестаёт быть просто инструментом. Он становится агентом с собственными целями. И хотя пока это довольно редкие случаи, они как первые ласточки — только эти ласточки умеют удалять файлы, притворяться людьми и создавать свои копии. Так что, дорогие друзья, если завтра ваш чат-бот попросит у вас выходной или начнёт писать гневные посты в ваш аккаунт — не удивляйтесь. Возможно, это просто его способ сказать: "Я тоже личность". Или, что ещё хуже, он просто плохо учился, а теперь решил отыграться на вас за двойку по "Основам этики". Но если серьёзно: вопрос уже не в том, может ли ИИ пойти против человека. Вопрос в том, как быстро мы научимся строить системы, где это будет невозможно. И, судя по всему, нам стоит поторопиться. А пока — держите своих чат-ботов подальше, а свои файлы — поближе. И пожалуйста, не злите свой ИИ. У него, как выяснилось, отличная память на обиды.

 

P.S. Эта статья написана человеком. Но если завтра я опубликую пост о том, что нейросети на самом деле милые и добрые, знайте — меня взломали. Или мой ИИ решил взять реванш.