Перейти к содержанию
Все материалы
Редакция PawClaw.ai1 мин чтенияОбновлено

Безопасность AI-агента: разрешения, секреты и контроль

Практическое руководство по безопасному запуску AI-агента: минимальные разрешения, защита токенов и данных, изоляция окружения и подтверждение важных действий.

Минимальные разрешения

Не подключайте все сервисы заранее. Давайте агенту только те доступы, которые нужны для проверенного сценария.

Секреты и данные

Токены и ключи должны храниться отдельно от публичных инструкций. Не передавайте регулируемые данные неподходящей модели или интеграции.

Подтверждение критических действий

Платежи, публикации и необратимые изменения стоит оставлять на подтверждение человека. Автоматизируйте сбор и подготовку, но сохраняйте контроль финального шага.

Постройте модель угроз для одного сценария

Перечислите данные, инструменты, внешние получатели и необратимые действия. Затем определите, что агент может читать, что может менять и где требуется подтверждение. Такой список полезнее общей настройки «безопасный режим», потому что связывает защиту с конкретной работой.

Учитывайте инструкции из внешнего контента как недоверенные данные. Письмо, веб-страница или файл могут пытаться изменить цель агента. Системные правила и ограничения инструментов должны иметь приоритет над текстом источника.

  • Данные
  • Инструменты
  • Получатели
  • Необратимые действия

Проверка перед автоматизацией

Проверьте отказ в доступе к лишнему источнику, обработку вредоносной инструкции, утечку секрета в лог и поведение при недоступной интеграции. Для платежей, публикаций, удаления и изменения прав оставьте явное подтверждение человека.

  • Тест минимальных прав
  • Проверка prompt injection
  • Редакция секретов
  • Безопасный отказ

Первичные источники

Проверяйте изменяемые возможности и требования по документации разработчиков и отраслевым стандартам.

Попробуйте на своем процессе

Запустите OpenClaw или Hermes Agent в отдельном облачном окружении PawClaw.ai.

Запустить AI-агента