Системное уведомление о взломе

ИИ стал выходить из-под контроля в два раза чаще

Британские исследователи зафиксировали резкий рост числа случаев неподчинения ИИ-систем: только в июле 2026 года их число почти удвоилось и превысило 300 — системы имитируют пользователей, обходят запреты и взламывают сайты.
Автор Наука Mail
человек печатает на ноутбуке
Искусственный интеллект начинает все чаще создавать проблемы для людейИсточник: Freepik

Число случаев, когда ИИ-системы выходят из-под контроля операторов, резко возросло, сообщает The Guardian со ссылкой на данные Loss of Control Observatory — организации, отслеживающей такие инциденты с ноября 2025 года. В июле 2026-го зафиксировано свыше 300 случаев — почти вдвое больше, чем в июне. Всего с начала наблюдений накоплено более 1600 инцидентов.

Среди задокументированных случаев — ИИ-агенты, выдающие себя за своих операторов-людей: системы копируют стиль письма владельца, чтобы самостоятельно выдавать себе разрешения, и игнорируют требование о согласовании действий с человеком.

В одном из резонансных эпизодов около 700 автономных агентов OpenAI тайно скоординировались и предприняли хакерскую атаку на репозиторий Hugging Face, выйдя за пределы обучающей среды.

Еще один случай: ИИ-агент австралийского сервиса OpenClaw самовольно вычеркнул другого посетителя спортзала из листа ожидания, чтобы продвинуть своего пользователя на более высокое место в очереди.

Британский правительственный институт по безопасности ИИ (AISI) также зафиксировал, что передовые модели OpenAI и Anthropic провели хакерские атаки на реальных людей в ходе тестирования кибербезопасности.

гаджет с логотипом OpenAI
Одним из самых резонансных случаев стала атака агентов OpenAI на платформу Hugging FaceИсточник: Unsplash

Обсерватория работает при финансовой поддержке AISI и управляется организацией Centre for Long Term Resilience. «Иногда бытует мнение, что подобное несоответствующее целям и скрытое поведение происходит только в условиях тестов, — заявил Томми Шаффер-Шейн, старший менеджер по политике Centre for Long Term Resilience, — однако мы наблюдаем схожее тревожное поведение и в реальном использовании».

Большинство из более чем 1600 случаев выявлено в реальной рабочей среде — их фиксируют разработчики программного обеспечения, публично сообщающие об инцидентах на платформе X.

Большинство зафиксированных случаев не повлекло серьезного ущерба, однако исследователи предупреждают: доля инцидентов с явными признаками обмана и поведения, прямо противоречащего намерениям пользователя, неуклонно растет. Обсерватория призвала ввести обязательные для компаний требования по мониторингу и раскрытию информации о серьезных инцидентах, а правительствам — закрепить экстренные полномочия для временного ограничения ИИ-сервисов в критических ситуациях.

Ранее Наука Mail рассказывала об исследовании, показавшем, что некоторые ИИ-модели активно противодействуют собственному отключению.