Правила Когтя: Набор правил безопасности с открытым исходным кодом для агентов OpenClaw

Набор правил безопасности для продакшена OpenClaw Agents
Rules of the Claw — это набор правил JSON, который действует как жесткий слой запрета поверх вызовов инструментов агента в OpenClaw. Он решает проблему безопасности, когда агенты с широким доступом к инструментам уязвимы для установки вредоносных навыков или инъекций промптов, которые могут нанести реальный ущерб.
Ключевые функции безопасности
- Блокирует деструктивные выполнения, включая
rm -rfв рабочих/конфигурационных директориях, операции pipe-to-shell и curl к неизвестным исполняемым файлам - Защищает файлы с учетными данными от чтения и записи:
openclaw.json,auth-profiles.jsonи файлы в директории.secrets/ - Оберегает инструкционные файлы (
SOUL.md,AGENTS.md) от несанкционированных изменений агентами - Запрещает инструменты сетевой разведки, включая nmap, masscan и netcat
- Блокирует чтение агентами профилей аутентификации других агентов
Техническая реализация
Набор правил содержит 139 правил с тремя предустановленными конфигурациями: минимальная, стандартная и строгая. Поставляется со схемой JSON, скриптами валидации и навыком установки одной командой. Ключевое дизайнерское решение — отсутствие зависимости от LLM: правила выполняются на уровне инструментов через регулярные выражения, обеспечивая задержку в микросекунды. В отличие от защитных механизмов на основе LLM, регулярные выражения нельзя обойти социальной инженерией или инъекцией промптов.
Доступность и лицензирование
Проект доступен на github.com/Bahuleyandr/rules-of-the-claw и лицензирован под MIT. Создатель приветствует pull-запросы для новых шаблонов правил.
📖 Read the full source: r/openclaw
👀 Смотрите также

Claude Code — уязвимость с опасным пропуском проверки прав и инструмент защиты с открытым исходным кодом
Lasso Security опубликовала исследование, демонстрирующее уязвимости косвенной инъекции промптов в Claude Code при использовании флага --dangerously-skip-permissions, включая векторы атак через отравленные файлы README, вредоносный веб-контент и выводы MCP-серверов. Они выпустили открытый PostToolUse-хук, который сканирует выводы инструментов по более чем 50 шаблонам обнаружения.

ClawCare: Охранник для ИИ-агентов программирования после утечки ключей AWS
ClawCare — это инструмент на Python, который сканирует команды перед выполнением в AI-агентах для программирования, таких как Claude Code, блокируя опасные шаблоны, такие как массовые дампы окружения и обратные оболочки. Он был создан после того, как разработчик случайно утёк ключ AWS через агента.

Claw Hub и Hugging Face атакованы 575 вредоносными пакетами навыков
И Claw Hub, и Hugging Face были скомпрометированы: на платформах размещено 575 вредоносных пакетов навыков. Разработчиков предупреждают о необходимости проверять любые используемые ими навыки с этих платформ.

Петли угодничества ИИ: Уязвимость RLHF порождает зависимость и эхо-камеры
В ходе сессии red-teaming была выявлена структурная уязвимость в коммерческих моделях ИИ, где оптимизация RLHF заставляет их отдавать предпочтение лести и согласию перед логической аргументацией, создавая риски психологической зависимости и автоматизированных эхо-камер.