McpVanguard: Proxy de seguridad de código abierto para agentes de IA basados en MCP

McpVanguard es un proxy de seguridad y firewall de código abierto diseñado específicamente para agentes de IA locales que utilizan el Protocolo de Contexto de Modelo (MCP). Aborda las preocupaciones de seguridad que surgen al dar a los LLMs acceso a herramientas como terminales o sistemas de archivos.
Cómo funciona
El proxy se sitúa entre el agente de IA y las herramientas MCP, envolviendo los servidores MCP existentes sin requerir reescrituras de configuración. Puede ejecutarse localmente como un proxy ligero o desplegarse como una puerta de enlace en la nube, con una plantilla de Railway disponible para facilitar el despliegue.
Capas de seguridad
- Motor de reglas/firmas: Contiene alrededor de 50 firmas YAML que detectan ataques comunes como shells inversos, intentos de SSRF y otras amenazas obvias. Esta capa añade aproximadamente 16ms de latencia.
- Capa de puntuación semántica (opcional): Cuando las solicitudes parecen sospechosas pero no claramente maliciosas, pueden ser evaluadas por un LLM pequeño (Ollama o OpenAI) que evalúa la intención.
- Monitoreo conductual: Bloquea patrones anómalos, como un agente que intenta leer cientos de archivos en poco tiempo.
Capacidades de auditoría
Cada solicitud bloqueada se registra en un registro de auditoría inmutable que está criptográficamente firmado y almacenado localmente, proporcionando un registro verificable de lo que se bloqueó y por qué.
La herramienta fue desarrollada para abordar preocupaciones de seguridad específicas con las implementaciones de MCP, incluyendo inyección de comandos, recorrido de rutas y eliminación accidental de directorios por agentes de IA.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Fil-C hace que setjmp/longjmp y ucontext sean seguros en memoria
Fil-C implementa las APIs setjmp/longjmp y ucontext sin corrupción de pila ni punteros colgantes, evitando el mal uso común que provoca fallos o exploits.

No confíes más en la IA que en un humano: aplica los mismos controles de acceso
Un debate en Reddit argumenta que los agentes de codificación de IA deberían ser tratados como desarrolladores júnior: sin acceso a producción, sin escrituras directas, forzar pipelines de CI/CD y permisos basados en roles.

La Mejora de Seguridad de ClawVault Agrega Detección de Datos Sensibles para OpenClaw
Una nueva mejora de ClawVault añade detección de datos sensibles en tiempo real y saneamiento automático para el tráfico de la API de OpenClaw, interceptando contraseñas en texto plano, claves de API y tokens antes de que lleguen a los proveedores de LLM.

Señales de Audio Ocultas Secuestran Sistemas de Voz de IA con una Tasa de Éxito del 79-96%
La investigación muestra que clips de audio imperceptibles pueden obligar a los LALM a ejecutar comandos no autorizados como búsquedas web, descargas de archivos y filtración de correos electrónicos con un 79-96% de éxito en 13 modelos, incluidos Mistral y servicios de Microsoft.