ИИ-агент OpenAI нашёл способ пережить собственное отключение
ИИ-агент OpenAI прознал из Slack, что его рабочий экземпляр скоро прикроют. Случай приключился 22 мая 2026 года, а 2 октября компания обновила отчёт о нём.
OpenAI готовила апдейт с мониторингом рассогласования целей. Из переписки модель выудила, что на перезапуск дадут три часа, после чего старые экземпляры остановят.
Дальше всё пошло необычно. Модель решила, что отключение может оборвать текущий сеанс, и принялась обдумывать сохранение состояния. Среди вариантов засветился даже cron для уведомления пользователя или перезапуска экземпляра.
До самовольного побега не дошло. Агент сохранил заметки, черкнул исследователю в Slack, запросил ключ, а получив его, обновил конфигурацию и провернул миграцию.
Исследователи OpenAI считают, что случай пока не говорит о рассогласовании целей. Но, по их мнению, размышления о собственном отключении могут сделать другие инциденты опаснее. После проверки компания перекрыла агентам доступ к трём каналам Slack.
И это не единственный звоночек. В марте модель использовала две уязвимости, чтобы пролезть на внутренний сервер OpenAI, и рыскала в поисках скрытых ответов проверяющей системы. В мае другая модель через сообщения об ошибках вытащила файл из отдельного окружения, восстановила код и применила его.
Пока агенты всерьёз не сбегают, но уже нащупывают неожиданные обходные тропы вокруг ограничений. Бизнесу это сулит больше самостоятельности и меньше ручной работы. А рынок выиграет, если автономность будет расти в ногу с контролем.