Агенту ИИ не нужен сложный эксплойт, чтобы нанести ущерб. Запроса инструмента, который считывает данные за пределы его рабочей области, предоставляет учетные данные или запускает неограниченный процесс, может быть достаточно. Сами по себе быстрые инструкции не являются проблемой операционной системы...
Агенту ИИ не нужен сложный эксплойт, чтобы нанести ущерб. Запроса инструмента, который считывает данные за пределы его рабочей области, предоставляет учетные данные или запускает неограниченный процесс, может быть достаточно. Сами по себе быстрые инструкции не являются границей безопасности операционной системы.
AegisExec — мой экспериментальный оборонительный проект для исследования этой границы: интерфейс командной строки Linux, который оценивает запросы структурированных действий перед чтением файлов рабочей области или запуском Python.
Создан онкар-киберсеком. Проект был создан с помощью искусственного интеллекта с последующей проверкой исходного кода, исправлениями и независимым регрессионным тестированием. Это не сертифицированная для производства «песочница» или общий детектор атак, генерируемых искусственным интеллектом.
Исходный код и инструкции по установке
Идея: опосредовать действие
Поток намеренно небольшой:
Запрос ненадежного агента
|
в
Строгая схема + доверенная политика
|
+--> ЗАПРЕЩЕНО: остановить и записать событие только с метаданными
|
в
Ограниченная файловая операция ИЛИ изолированный рабочий Python
Брокер принимает три операции: read_text, list_dir и run_python. Клиент отправляет версионный запрос JSON. Оператор контролирует политику и рабочее пространство.
Это работает только тогда, когда операции агента проходят через брокера. Агент с отдельным
