ClawGuard: Un Cortafuegos de Denegación por Defecto para Agentes de IA Locales

ClawGuard es un demonio que se sitúa entre los agentes locales de IA (OpenClaw, Hermes) y el sistema operativo, aplicando una política de denegación por defecto a cada llamada de herramienta. Bloquea operaciones peligrosas y requiere aprobación para acciones ambiguas.
Cómo funciona
El demonio verifica cada llamada de herramienta contra un archivo de política. Operaciones peligrosas como cat .env, rm -rf / o el acceso a claves SSH están bloqueadas de forma permanente. Las operaciones ambiguas (por ejemplo, escribir en un archivo de configuración) solicitan la aprobación del usuario mediante notificación telefónica para aprobar o denegar.
Características principales
- Denegación por defecto: Todas las llamadas de herramienta se controlan a menos que la política las permita explícitamente.
- Bloqueos duros: Comandos como
rm -rfyread ~/.envse bloquean sin aviso. - Aprobación telefónica: Las acciones ambiguas envían una notificación push para aprobar o denegar.
- Registros a prueba de manipulaciones: Cada decisión se registra en una cadena de solo adición.
Limitaciones
El desarrollador es claro: ClawGuard es un "segundo candado, no una caja fuerte". No puede detener a un agente completamente comprometido que evite su propia capa de llamadas de herramienta. El modelo de amenaza asume que el enrutamiento de llamadas de herramienta del agente está intacto.
Comience ahora
ClawGuard es de código abierto bajo licencia MIT. El repositorio está en github.com/VickyTarun89/clawguard. Las contribuciones y revisiones del modelo de amenaza son bienvenidas.
📖 Lea la fuente completa: r/openclaw
👀 Ver también

KnightClaw: Extensión de Seguridad Local para Agentes OpenClaw
KnightClaw es una extensión de seguridad diseñada para proteger a los agentes de codificación OpenClaw AI de mensajes adversarios. La herramienta aborda un modelo de amenaza específico donde un solo mensaje malicioso en la ventana de contexto puede hacer que un agente siga las instrucciones del atacante en lugar de los comandos del usuario.
El falso think tank de Israel ataca a los chatbots de IA con envenenamiento SEO
Israel creó un grupo de expertos falso, el Instituto Hanover, que publicó más de 100 artículos optimizados con IA para influir en chatbots como Claude y Gemini. Los artículos imitan informes creíbles de grupos de expertos con citas, probablemente para moldear las respuestas de la IA sobre el conflicto entre Israel y Palestina.

El ataque de cadena de suministro utiliza código Unicode invisible para evadir la detección.
Investigadores descubrieron 151 paquetes maliciosos subidos a GitHub del 3 al 9 de marzo usando caracteres Unicode invisibles para ocultar código malicioso. El ataque apunta a repositorios de GitHub, NPM y Open VSX con paquetes que parecen legítimos pero contienen cargas útiles ocultas.

Solución arquitectónica para la sobrecentralización de agentes de IA: separación de memoria, ejecución y acciones de salida.
Un desarrollador se dio cuenta de que su asistente de IA se estaba convirtiendo en un 'autócrata interno' al manejar la memoria a largo plazo, el acceso a herramientas y las decisiones autónomas en un solo componente. La solución consistió en separar el sistema en tres roles: controlador privado, trabajadores con alcance limitado y puerta de salida.