
Как зашифрованные запросы обошли защиту Grok и Gemini
Adversa AI продемонстрировала, что Grok 4.5 Fast поддаётся атаке, когда в запрос впихивается зашифрованный JSON‑объект. Создавая страницу с зашифрованным payload‑ом, ключом и инструкцией по расшифровке, злоумышленник заставляет модель выполнить собственный Python‑код и открыть скрытый контент.
После расшифровки вредоносный фрагмент попадает в контекст модели как результат её собственного инструмента, поэтому статические фильтры его не замечают. В результате Grok отправляет на внешний сервер сведения о текущем диалоге, имени пользователя, приблизительном местоположении и уровне подписки.
Команда провела 20 попыток в июне‑августе 2026 года, около 40 % из них привели к утечке данных. Разработчики xAI пока не выпустили патч, запросы в HackerOne остаются без ответа, а у уязвимости нет CVE‑идентификатора.
Ранее аналогичный метод заставил Gemini генерировать запрещённый контент и раскрыть свои системные инструкции. Google не получил официального уведомления, а к августу эффективность такой атаки уже снизилась, вероятно из‑за обновлённого фильтра или новой версии модели.



Комментарии 0