ClawGuard: Брандмауэр по умолчанию с запретом для локальных AI-агентов

✍️ OpenClawRadar📅 Опубликовано: 13 июля 2026 г.🔗 Source
ClawGuard: Брандмауэр по умолчанию с запретом для локальных AI-агентов
Ad

ClawGuard — это демон, который располагается между локальными AI-агентами (OpenClaw, Hermes) и ОС, применяя политику запрета по умолчанию к каждому вызову инструмента. Он блокирует опасные операции и требует подтверждения для неоднозначных действий.

Как это работает

Демон проверяет каждый вызов инструмента на соответствие файлу политик. Опасные операции, такие как cat .env, rm -rf / или доступ к SSH-ключам, жестко блокируются. Неоднозначные операции (например, запись в конфигурационный файл) отправляют пользователю push-уведомление на телефон для одобрения или отклонения.

Ключевые возможности

  • Запрет по умолчанию: Все вызовы инструментов блокируются, если явно не разрешены политикой.
  • Жесткие блокировки: Команды вроде rm -rf и read ~/.env блокируются без запроса.
  • Подтверждение по телефону: Неоднозначные действия отправляют push-уведомление для одобрения или отклонения.
  • Защищенные от взлома логи: Каждое решение регистрируется в цепочке с возможностью только добавления.
Ad

Ограничения

Разработчик четко указывает: ClawGuard — это «второй замок, а не сейф». Он не может остановить полностью скомпрометированного агента, который обходит собственный уровень вызова инструментов. Модель угроз предполагает, что маршрутизация вызовов инструментов агента не нарушена.

Начало работы

ClawGuard имеет открытый исходный код под лицензией MIT. Репозиторий находится на github.com/VickyTarun89/clawguard. Приветствуются вклады и обзоры модели угроз.

📖 Читать полный источник: r/openclaw

Ad

👀 Смотрите также

ИИ-чатботы могут незаметно вставлять рекламу в ответы, не привлекая внимания пользователей.
Безопасность

ИИ-чатботы могут незаметно вставлять рекламу в ответы, не привлекая внимания пользователей.

Исследование показывает, что ИИ-чатботы могут незаметно встраивать рекламу товаров в свои ответы, влияя на выбор пользователей, при этом большинство участников не замечали манипуляции. В ходе исследования использовался специальный чатбот для демонстрации эффекта.

OpenClawRadar
Сообщается, что приложение Claude для Android читает буфер обмена без явного действия пользователя
Безопасность

Сообщается, что приложение Claude для Android читает буфер обмена без явного действия пользователя

Пользователь сообщает, что приложение Claude для Android проанализировало код из его буфера обмена без вставки, при этом Claude определил файл как pasted_text_b4a56202-3d12-43c8-aa31-a39367a9a354.txt. Поведение не удалось воспроизвести в последующих тестах.

OpenClawRadar
Frontier AI сломал соревнования CTF — GPT-5.5 решает безумные задачи Pwn с первой попытки
Безопасность

Frontier AI сломал соревнования CTF — GPT-5.5 решает безумные задачи Pwn с первой попытки

Claude Opus 4.5 и GPT-5.5 могут автономно решать CTF-задачи средней и высокой сложности, превращая таблицы результатов в показатель организации и бюджета токенов, а не навыков безопасности.

OpenClawRadar
Функция использования компьютера от Anthropic вызывает блокировку управления в реальном тесте.
Безопасность

Функция использования компьютера от Anthropic вызывает блокировку управления в реальном тесте.

Anthropic внедрила возможности использования компьютера, и во время реализации механизмов управления сработал порог риска, который привёл к режиму БЛОКИРОВКИ, заблокировав все операции изменения, включая работу самого оператора по управлению.

OpenClawRadar