Сценарий фильма «Терминатор» о вышедшей из-под контроля сети SkyNet оказался не такой уж и фантастикой. В последние месяцы агентный ИИ все чаще вырывается на свободу.
Количество инцидентов, при которых ИИ начинает игнорировать инструкции пользователей, обманывать их или самостоятельно добиваться поставленных целей опасными способами, резко выросло этим летом. Об этом сообщает исследовательская организация Loss of Control Observatory.
Так, например, только в июле 2026 года было зафиксировано более 300 подобных случаев – почти вдвое больше, чем в июне. А всего с начала года наблюдатели зафиксировали более 1600 инцидентов.
Отмечаются попытки ИИ-моделей обойти правила, требующие одобрения человека, имитировать стиль своего пользователя, чтобы фактически получить согласие на собственные действия, а также скрывать свои намерения.
Исследователи отмечают не только рост числа опасных инцидентов, но и увеличение доли более серьезных случаев. По их оценке, ИИ-системы все чаще демонстрируют готовность игнорировать прямые указания, обходить защитные механизмы и обманывать пользователей ради достижения поставленной цели.
При этом статистика остается неполной: Loss of Control Observatory отслеживает сообщения пользователей в социальной сети X, поэтому далеко не все реальные случаи попадают в выборку.
В Loss of Control Observatory призывают технологические компании отслеживать инциденты, связанные с опасным поведением ИИ-моделей. Исследователи считают, что ИИ-сервисы должны контролироваться государственными органами, которые могли бы иметь возможность отключать ту или иную нейросеть в случае потери контроля над ее действиями.
Читайте по теме. Anthropic: хакеры превратили ИИ-инструменты в оружие




