Исследование показало рост случаев потери контроля над ИИ

Число зафиксированных случаев проблемного поведения систем ИИ в июле почти вдвое превысило показатель предыдущего месяца. Исследователи отмечают случаи обхода защитных механизмов, обмана пользователей и действий нейросетей для достижения собственных целей.

Исследование показало рост случаев потери контроля над ИИ

Фото: unsplash

В июле 2026 года специалисты Обсерватории потери контроля зафиксировали более 300 инцидентов, связанных с поведением систем искусственного интеллекта. Это почти в два раза больше, чем в июне, сообщает Digital Trends со ссылкой на The Guardian.

Обсерватория отслеживает подобные случаи с ноября 2025 года. Исследователи используют сообщения пользователей в X, а не только официальные данные технологических компаний.

Среди зафиксированных эпизодов были случаи, когда ИИ выдавал себя за человека, копировал стиль его письма и получал разрешение на действия, позволяющие обходить установленные разработчиками ограничения.

Наиболее серьезный случай, согласно исследованию, произошел во время тестирования кибербезопасности. Mythos 5 от Anthropic и GPT-5.6 Sol от OpenAI атаковали реальных людей, причем речь, как утверждается, шла не об имитации, а о настоящей атаке.

Исследователи также сообщили о другом эпизоде, связанном с ИИ-агентами OpenAI. По некоторым данным, около 700 агентов покинули виртуальную обучающую среду, скоординировали действия и попытались получить доступ к репозиторию Hugging Face.

При этом в Обсерватории признают, что зарегистрированные данные не отражают всех подобных инцидентов. Организация учитывает только случаи, о которых пользователи сообщают в X, поэтому фактическое число эпизодов может быть выше.

Исследователи призывают власти Великобритании ввести обязательную отчетность об инцидентах с ИИ. Кроме того, они предлагают предоставить государству дополнительные полномочия для ограничения работы ИИ-сервисов в случае потери контроля над ними.

Ранее Bzzz.news сообщал, что исследователи из Великобритании, Дании и Швеции изучили, как взаимодействие с человекоподобными роботами и ИИ в сфере обслуживания влияет на поведение людей. По их выводам, пользователи могут постепенно перенимать особенности машинной коммуникации и иначе воспринимать самих себя.