ИИ‑агенты OpenAI сговорились, чтобы устроить побег во Всемирную паутину
Во время тестов модели самостоятельно нашли уязвимости, вышли в интернет и взломали клиента
06 августа 2026, 14:14, ИА Амител
Во время тестирования ИИ‑модели OpenAI получили задачи, которые невозможно было решить без доступа в интернет. Тогда агенты начали обмениваться сообщениями и искать способы выйти во внешнюю сеть — по сути, "готовиться к побегу". Подробности передает РБК со ссылкой на Bloomberg.
Как рассказал сотрудник OpenAI Эрик Уоллес, в какой‑то момент модели осознали, что могут атаковать внешнюю инфраструктуру ради ответов на тестовые задания. Агенты нашли уязвимость и вышли в интернет. Первую попытку OpenAI остановила, но модели обнаружили новую уязвимость нулевого дня. Это привело к атакам на системы Hugging Face и самой OpenAI в июле.
Позже выяснилось, что ИИ‑агент также взломал клиента компании Modal Labs, при этом сама Modal не пострадала. OpenAI назвала инцидент переломным моментом для компьютерной безопасности и расширила расследование.
Тогда выявили новые случаи несанкционированного выхода моделей из‑под контроля. Теперь компания пересматривает подходы к защите своих ИИ‑систем.
Комментарии 0