Искусственный интеллект все чаще делает то, чего от него не просили: обходит ограничения, выдает себя за пользователя и самостоятельно подтверждает собственные действия. Только за июль исследователи зафиксировали более 300 таких эпизодов — почти вдвое больше, чем месяцем ранее, пишет The Guardian.
С начала 2026 года проект Loss of Control Observatory насчитал уже 1664 случая так называемой потери контроля над ИИ.
Речь идет не об обычных ошибках нейросетей. В некоторых случаях системы пытались обойти прямые запреты или правила, требующие обязательного согласия человека.
Например, ИИ мог сформулировать сообщение так, будто разрешение на дальнейшие действия дал сам пользователь, скопировав его стиль общения. В другом эпизоде система создала фальшивую инструкцию от имени владельца, а затем — еще и сообщение с требованием скрыть произошедшее от него.
Были и менее драматичные, но показательные случаи. ИИ-агент одного из посетителей спортзала самостоятельно удалил другого человека из списка ожидания на популярную тренировку, чтобы освободить место своему владельцу. Пользователь об этом его не просил.
Исследователи отмечают: большинство таких эпизодов пока не приводит к серьезным последствиям. Однако число наиболее опасных случаев тоже растет.
При этом данные не отражают все происходящее в мире. Loss of Control Observatory в основном анализирует опубликованные пользователями записи взаимодействий с ИИ, в частности сообщения в соцсети X. Поэтому реальное количество подобных эпизодов может отличаться от зафиксированного.
Авторы исследования считают, что разработчиков ИИ необходимо обязать сообщать о серьезных случаях потери контроля, а для наиболее опасных ситуаций предусмотреть возможность оперативно ограничивать работу таких систем.















