DS

AGT: Безопасное управление AI-агентами

AGT — платформа для безопасного развертывания автономных AI-агентов. Она решает три задачи: контроль разрешённых действий, идентификация агента и аудит решений. В отличие от prompt-уровня, AGT перехватывает вызовы в детерминированном коде, делая запрещённые действия структурно невозможными.

Модульная архитектура позволяет начать с политики и аудита, а затем добавить песочницу, SRE, compliance и другие слои. Быстрый старт — YAML-политика, которая оценивается на каждый вызов инструмента.

AGT не борется с промпт-инъекциями на уровне модели, где даже GPT-4o имеет 100% успех атак (Andriushchenko et al., ICLR 2025). Вместо этого каждое действие проверяется до того, как достигнет сети.

GitHub ★ 4,953

0 комментариев

Редактор комментария
Пока нет комментариев
Станьте первым, кто оставит мнение на этот топик