ADR (Agentic AI Detection and Response) — корпоративная система безопасности для ИИ-агентов. Она защищает как внутренние инструменты сотрудников (Cursor, Claude Code, Codex), так и клиентские агенты вроде ИИ-поддержки.
Решение работает в продакшене Uber, а статья с его описанием принята на MLSys 2026. К публикации прилагаются PDF доклада и слайдов.
Архитектура строится на четырёх направлениях:
Observability — сбор намерений, вызовов инструментов и трасс выполнения для 7+ ИИ-инструментов на macOS, Linux и Windows
Benchmark — ADR-Bench: 300+ задач, 133 MCP-сервера, покрытие всех 17 техник атак на агентов
Detection — двухуровневая схема: быстрый отбор с высокой полнотой плюс глубокий агентный разбор подозрительных сессий
Prevention — блокировка небезопасных действий; в открытую версию пока не вошла
В репозитории опубликованы ADR Sensor, ADR-Bench и ADR Detector. Офлайн-движок ADR Explorer, который усиливает детекцию через red teaming до развёртывания, в состав релиза не включён.
Структура проекта: каталог Sensor/ отвечает за сбор и нормализацию телеметрии, Detection/ — за детектор, бенчмарк и базовые методы, а docs/REPRODUCIBILITY.md описывает пошаговое воспроизведение результатов и графиков.
Лицензия — Apache 2.0, стороннний вендоренный код идёт под MIT. Бенчмарк содержит только синтетические данные: поддельные учётки, эмулированные среды и сценарии prompt-injection — исключительно для оборонительных исследований.
GitHub ★ 494
