McpVanguard: Proxy de seguridad de código abierto para agentes de IA basados en MCP

McpVanguard es un proxy de seguridad y firewall de código abierto diseñado específicamente para agentes de IA locales que utilizan el Protocolo de Contexto de Modelo (MCP). Aborda las preocupaciones de seguridad que surgen al dar a los LLMs acceso a herramientas como terminales o sistemas de archivos.
Cómo funciona
El proxy se sitúa entre el agente de IA y las herramientas MCP, envolviendo los servidores MCP existentes sin requerir reescrituras de configuración. Puede ejecutarse localmente como un proxy ligero o desplegarse como una puerta de enlace en la nube, con una plantilla de Railway disponible para facilitar el despliegue.
Capas de seguridad
- Motor de reglas/firmas: Contiene alrededor de 50 firmas YAML que detectan ataques comunes como shells inversos, intentos de SSRF y otras amenazas obvias. Esta capa añade aproximadamente 16ms de latencia.
- Capa de puntuación semántica (opcional): Cuando las solicitudes parecen sospechosas pero no claramente maliciosas, pueden ser evaluadas por un LLM pequeño (Ollama o OpenAI) que evalúa la intención.
- Monitoreo conductual: Bloquea patrones anómalos, como un agente que intenta leer cientos de archivos en poco tiempo.
Capacidades de auditoría
Cada solicitud bloqueada se registra en un registro de auditoría inmutable que está criptográficamente firmado y almacenado localmente, proporcionando un registro verificable de lo que se bloqueó y por qué.
La herramienta fue desarrollada para abordar preocupaciones de seguridad específicas con las implementaciones de MCP, incluyendo inyección de comandos, recorrido de rutas y eliminación accidental de directorios por agentes de IA.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Demandante pro se oculta inyecciones de aviso de IA en una presentación judicial
Un demandante pro se en Connecticut escondió inyecciones de prompt en fuente blanca de 3 puntos en documentos judiciales, instruyendo a cualquier IA a ponerse de su lado. El tribunal lo detectó y lo sancionó.

Claude Code --vulnerabilidad de omisión peligrosa de permisos y herramienta de defensa de código abierto
Lasso Security publicó una investigación que muestra vulnerabilidades de inyección indirecta de instrucciones en Claude Code al usar la bandera --dangerously-skip-permissions, con vectores de ataque que incluyen archivos README envenenados, contenido web malicioso y salidas de servidores MCP. Lanzaron un gancho PostToolUse de código abierto que escanea las salidas de herramientas contra más de 50 patrones de detección.

El Problema del Guardia Uniformado: Por qué los Sandboxes de Agentes Necesitan Identidad, No Solo Política
El sandbox openshell de Nemoclaw aplica políticas de alcance a binarios, lo que permite que el malware viva de la tierra usando los mismos binarios que el agente. ZeroID, una capa de identidad de agente de código abierto, aplica políticas de seguridad a agentes respaldados por identidades seguras.

ClawGuard: Puerta de Enlace de Seguridad de Código Abierto para la Protección de Credenciales de la API OpenClaw
ClawGuard es una puerta de enlace de seguridad que se sitúa entre los agentes de IA y las API externas, utilizando credenciales ficticias en la máquina del agente mientras almacena los tokens reales por separado. Proporciona aprobación por Telegram para llamadas sensibles y mantiene un registro de auditoría de las solicitudes.