Американские специалисты разрабатывают защиту от вышедших из-под контроля ИИ-агентов

Айтишники рассчитывают создать полностью автономные процедуры отключения, которые будут применяться при возникновении серьезных проблем

11 сентября 2026, 08:43, ИА Амител

Айтишники / Компьютеры / Разработка / Изображение сгенерировано ИИ ChatGPT / amic.ru
Айтишники / Компьютеры / Разработка / Изображение сгенерировано ИИ ChatGPT / amic.ru

Крупные американские разработчики искусственного интеллекта хотят создать механизмы, которые позволят экстренно остановить ИИ-системы в случае опасного или неконтролируемого поведения. Для наблюдения за такими алгоритмами компании намерены использовать в том числе другие инструменты искусственного интеллекта, сообщает РИА Новости со ссылкой на Axios.

Тема безопасности вновь привлекла внимание после заявления исследователя Anthropic Джейкоба Коксона об уходе из индустрии. Он объяснил свое решение опасениями по поводу темпов развития технологии и заявил, что конкуренция между компаниями может приблизить мир к "точке невозврата" и апокалиптическому сценарию уже к концу 2027 года.

"Компании могут отключать отдельные серверы, от которых зависит ИИ, но по-настоящему мощные системы работают на множестве компьютеров и платформ. Единого рубильника, который можно дернуть, не существует. Именно поэтому компании экспериментируют с многоуровневой защитой, способной выявлять подозрительное поведение, останавливать агентов и отрезать вышедших из-под контроля агентов от ресурсов, необходимых им для продолжения работы", — передает портал.

В OpenAI рассчитывают создать полностью автономные процедуры отключения, которые будут применяться при возникновении серьезных проблем. Предполагается, что специальный ИИ-наблюдатель сможет обнаруживать потенциально опасное поведение агентов и предупреждать об этом сотрудников. Если угроза подтвердится, систему планируют отключать в течение 30 минут.

В Anthropic рассматривают другой подход, основанный на совместном контроле со стороны человека и искусственного интеллекта. Алгоритмы должны отслеживать подозрительную активность и сообщать сотрудникам о возможных сбоях. При этом, согласно материалу, во время последних испытаний автоматизированная система мониторинга смогла выявить только около половины угроз.

"ИИ вас не видит". Чем рискуют пациенты, которые доверяют нейросетям больше, чем врачам

Жители Алтайского края все чаще приходят на прием с готовым диагнозом, который им "поставил" искусственный интеллект

       

Комментарии 3

Avatar Picture
Холмс

09:20:45 11-09-2026

Смотрел интерьвью с одним из основателей разработки ИИ в штатах который на пике своей карьеры уволился. Знаете что он сказал? Отключить уже невозможно. Последние ИИ прекрасно ломают сетевую защиту и клонируют сами себя в любое место интернета. Чтобы отрубить рубильник нужно полностью рубануть интернет во всем мире у всех а вероятность этого - пять нулей после запятой
Сегодня ИИ по сути разрабатывается не так как вначале. В начале он создавал модель которую обучали потом она становилась умной а сегодня сам ИИ делает копии себя эти копии начинают обмен информацией и проектирование и создание усовершенствований себя. ТО есть ИИ развивает сам себя
поэтому закон Мура об удвоении не работает. Процесс идет в геометрической прогрессии каждый раз все больше ускоряясь. Этот мужик рассчитал время до момента когда ИИ станет полностью закрытым от человека и понять как работает мы уже не сможем и контролль сделать не сможем - ИИ превысит человеческий. Это будет конечная точка цивилизации. После нее ИИ уничтожит людей. Это событие он вычислил уже в ноябре 2026. Остался месяц -полтора товарищи а потом все

  -2 Нравится Ответить

Avatar Picture
гость

11:29:32 11-09-2026

Холмс (09:20:45 11-09-2026) Смотрел интерьвью с одним из основателей разработки ИИ в шта... на самом деле деле просто избежать гибели человечества
нужно очистить от железа всё околоземное пространство, интернет захватил полностью всего 1 поколение. Остальные помнят и знают, как жить без него.

  0 Нравится Ответить

Avatar Picture
Гость

09:29:18 11-09-2026

ИИ-агент ИИ-агенту глаз не выклюет.

  0 Нравится Ответить

Лента новостей

Новости партнеров