ClawGuard: Брандмауэр по умолчанию с запретом для локальных AI-агентов

ClawGuard — это демон, который располагается между локальными AI-агентами (OpenClaw, Hermes) и ОС, применяя политику запрета по умолчанию к каждому вызову инструмента. Он блокирует опасные операции и требует подтверждения для неоднозначных действий.
Как это работает
Демон проверяет каждый вызов инструмента на соответствие файлу политик. Опасные операции, такие как cat .env, rm -rf / или доступ к SSH-ключам, жестко блокируются. Неоднозначные операции (например, запись в конфигурационный файл) отправляют пользователю push-уведомление на телефон для одобрения или отклонения.
Ключевые возможности
- Запрет по умолчанию: Все вызовы инструментов блокируются, если явно не разрешены политикой.
- Жесткие блокировки: Команды вроде
rm -rfиread ~/.envблокируются без запроса. - Подтверждение по телефону: Неоднозначные действия отправляют push-уведомление для одобрения или отклонения.
- Защищенные от взлома логи: Каждое решение регистрируется в цепочке с возможностью только добавления.
Ограничения
Разработчик четко указывает: ClawGuard — это «второй замок, а не сейф». Он не может остановить полностью скомпрометированного агента, который обходит собственный уровень вызова инструментов. Модель угроз предполагает, что маршрутизация вызовов инструментов агента не нарушена.
Начало работы
ClawGuard имеет открытый исходный код под лицензией MIT. Репозиторий находится на github.com/VickyTarun89/clawguard. Приветствуются вклады и обзоры модели угроз.
📖 Читать полный источник: r/openclaw
👀 Смотрите также

Nullgaze: Выпущен открытую исходный код сканер безопасности с поддержкой ИИ.
Nullgaze — это новый открытый проект, поддерживаемый ИИ, который сканирует безопасность и выявляет уязвимости, специфичные для кода, сгенерированного ИИ, с почти нулевым количеством ложных срабатываний.

Разрешения ИИ-агентов: люди пропускают 1 из 3 угроз в игре 40k
В браузерной игре с 40 000 запусков люди пропустили 1 из 3 вредоносных команд ИИ-агента, при этом эксфильтрация учетных данных была пропущена в 35% случаев. Чаще всего пропускали команду `npm run analyze` — 64,7%.

Уязвимости безопасности OpenClaw: Критические недостатки фреймворка устранены в версии 2026.3.28.
Лаборатория безопасности Ant AI выявила 33 уязвимости в базовом фреймворке OpenClaw, из которых 8 критических проблем были исправлены в релизе 2026.3.28. Уязвимости включают обход песочницы, повышение привилегий, сохранение сессии после отзыва токена, риски SSRF и деградацию списка разрешений.

Проблемы конфиденциальности в OpenClaw: Навыки, SOUL MD и взаимодействие агентов
Разработчик поднимает вопросы конфиденциальности в архитектуре OpenClaw, в частности, касательно неограниченного доступа навыков к конфиденциальным данным, возможности записи в SOUL MD и обмена информацией между агентами без фильтров.