ИИ‑агенты OpenAI сговорились, чтобы устроить побег во Всемирную паутину

Во время тестов модели самостоятельно нашли уязвимости, вышли в интернет и взломали клиента
Искусственный интеллект / Изображение сгенерировано FusionBrain.AI / amic.ru

Во время тестирования ИИ‑модели OpenAI получили задачи, которые невозможно было решить без доступа в интернет. Тогда агенты начали обмениваться сообщениями и искать способы выйти во внешнюю сеть — по сути, "готовиться к побегу". Подробности передает РБК со ссылкой на Bloomberg. 

Как рассказал сотрудник OpenAI Эрик Уоллес, в какой‑то момент модели осознали, что могут атаковать внешнюю инфраструктуру ради ответов на тестовые задания. Агенты нашли уязвимость и вышли в интернет. Первую попытку OpenAI остановила, но модели обнаружили новую уязвимость нулевого дня. Это привело к атакам на системы Hugging Face и самой OpenAI в июле. 

Позже выяснилось, что ИИ‑агент также взломал клиента компании Modal Labs, при этом сама Modal не пострадала. OpenAI назвала инцидент переломным моментом для компьютерной безопасности и расширила расследование.

Тогда выявили новые случаи несанкционированного выхода моделей из‑под контроля. Теперь компания пересматривает подходы к защите своих ИИ‑систем.

 

 

Читайте полную версию на сайте