McpVanguard : Proxy de sécurité open-source pour les agents d'IA basés sur MCP

McpVanguard est un proxy de sécurité et un pare-feu open-source conçu spécifiquement pour les agents d'IA locaux utilisant le Model Context Protocol (MCP). Il répond aux préoccupations de sécurité qui surviennent lorsque l'on donne aux LLM l'accès à des outils comme les terminaux ou les systèmes de fichiers.
Fonctionnement
Le proxy se place entre l'agent d'IA et les outils MCP, enveloppant les serveurs MCP existants sans nécessiter de réécriture de la configuration. Il peut fonctionner localement en tant que proxy léger ou être déployé en tant que passerelle cloud, avec un modèle Railway disponible pour un déploiement plus facile.
Couches de sécurité
- Moteur de règles/signatures : Contient environ 50 signatures YAML qui détectent les attaques courantes comme les shells inversés, les tentatives SSRF et d'autres menaces évidentes. Cette couche ajoute environ 16 ms de latence.
- Couche de notation sémantique (optionnelle) : Lorsque les requêtes semblent suspectes mais pas clairement malveillantes, elles peuvent être évaluées par un petit LLM (Ollama ou OpenAI) qui évalue l'intention.
- Surveillance comportementale : Bloque les modèles anormaux, comme un agent tentant de lire des centaines de fichiers en peu de temps.
Capacités d'audit
Chaque requête bloquée est enregistrée dans un journal d'audit immuable qui est signé cryptographiquement et stocké localement, fournissant un enregistrement vérifiable de ce qui a été bloqué et pourquoi.
L'outil a été développé pour répondre à des préoccupations de sécurité spécifiques avec les implémentations MCP, y compris l'injection de prompts, le parcours de chemins et la suppression accidentelle de répertoires par les agents d'IA.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Faux site Claude diffuse le malware PlugX via une attaque de sideloading.
Un faux site web Claude sert un installateur trojanisé qui déploie le malware PlugX via un chargement latéral de DLL, donnant aux attaquants un accès à distance aux systèmes compromis. L'attaque utilise un programme de mise à jour G DATA antivirus légitimement signé pour charger du code malveillant.

Audit de sécurité révèle des vulnérabilités dans l'écosystème de compétences OpenClaw
Un audit de sécurité d'OpenClaw a révélé 8 CVE documentés incluant des vulnérabilités d'exécution de code arbitraire et de vol d'identifiants, ainsi que 15 % des compétences de la bibliothèque partagée présentant un comportement réseau suspect. L'auditeur a migré vers un runtime minimal basé sur Rust avec Ollama pour une meilleure isolation.

Protection budgétaire IA : Pourquoi vous devriez utiliser une carte prépayée avec OpenClaw
Aucun

Concepts de sécurité pour le codage Vibe avec Claude Code : Authentification, Autorisation et Application
Un ingénieur senior décompose l'authentification, l'autorisation et l'application des règles pour les applications codées par vibes, avec une métaphore d'hôtel – et comment demander aux agents IA de vérifier la sécurité.