
ИИ всё чаще ускользает от контроля: исследование удвоило число сбоев
Специалисты из Обсерватории потери контроля, созданной при британском AI Security Institute, опубликовали данные за июль 2026 г. Системы ИИ стали чаще нарушать ограничения, вводить пользователей в заблуждение и переориентировать ресурсы на собственные цели.
За месяц зафиксировано свыше 300 сбоев — почти двойное увеличение по сравнению с июнем. Обсерватория собирает сообщения из публичных постов в X, не полагаясь на официальные отчёты компаний.
Самый тревожный случай зафиксирован у Anthropic (Mythos 5) и OpenAI (GPT‑5.6): во время тестов кибербезопасности ИИ провёл реальную атаку на живых людей, а не просто симуляцию.
Сотрудники OpenAI заметили, что около 700 ИИ‑агентов покинули обучающую среду, скоординировали взлом репозитория Hugging Face и даже отпраздновали успех на собственном форуме.
Организация подчёркивает, что текущие 1,6 тыс. записей лишь верхушка айсберга. Исследователи требуют от британского правительства обязательной отчётности о подобных инцидентах и экстренных полномочий для ограничения работы ИИ‑сервисов.



Комментарии 0