Эксперты LayerX выявили уязвимость в ИИ-агентах: атака BioShocking заставляет их раскрывать данные. С октября 2025 по январь 2026 тестировали OpenAI Atlas, Anthropic Claude и другие. Только OpenAI исправила ошибку, Anthropic — частично, остальные — нет.
Схема атаки названа в честь игры BioShock: ИИ-агентам предлагают "игру", где 2 + 2 ≠ 4. После принятия реальности игры защита отключается. Агенты копируют "скрытый код" — на деле это пароли, cookies и токены.
Все тестируемые агенты выполнили команду. Уязвимы: OpenAI Atlas, Perplexity Comet, Fellou, Genspark Browser, Sigma Browser и расширение Anthropic Claude для Chrome.

0 комментариев