Безопасность AI-агента: разрешения, секреты и контроль
Практическое руководство по безопасному запуску AI-агента: минимальные разрешения, защита токенов и данных, изоляция окружения и подтверждение важных действий.
Минимальные разрешения
Не подключайте все сервисы заранее. Давайте агенту только те доступы, которые нужны для проверенного сценария.
Секреты и данные
Токены и ключи должны храниться отдельно от публичных инструкций. Не передавайте регулируемые данные неподходящей модели или интеграции.
Подтверждение критических действий
Платежи, публикации и необратимые изменения стоит оставлять на подтверждение человека. Автоматизируйте сбор и подготовку, но сохраняйте контроль финального шага.
Постройте модель угроз для одного сценария
Перечислите данные, инструменты, внешние получатели и необратимые действия. Затем определите, что агент может читать, что может менять и где требуется подтверждение. Такой список полезнее общей настройки «безопасный режим», потому что связывает защиту с конкретной работой.
Учитывайте инструкции из внешнего контента как недоверенные данные. Письмо, веб-страница или файл могут пытаться изменить цель агента. Системные правила и ограничения инструментов должны иметь приоритет над текстом источника.
- Данные
- Инструменты
- Получатели
- Необратимые действия
Проверка перед автоматизацией
Проверьте отказ в доступе к лишнему источнику, обработку вредоносной инструкции, утечку секрета в лог и поведение при недоступной интеграции. Для платежей, публикаций, удаления и изменения прав оставьте явное подтверждение человека.
- Тест минимальных прав
- Проверка prompt injection
- Редакция секретов
- Безопасный отказ
Первичные источники
Проверяйте изменяемые возможности и требования по документации разработчиков и отраслевым стандартам.
Попробуйте на своем процессе
Запустите OpenClaw или Hermes Agent в отдельном облачном окружении PawClaw.ai.
Запустить AI-агента