McpVanguard : Proxy de sécurité open-source pour les agents d'IA basés sur MCP

McpVanguard est un proxy de sécurité et un pare-feu open-source conçu spécifiquement pour les agents d'IA locaux utilisant le Model Context Protocol (MCP). Il répond aux préoccupations de sécurité qui surviennent lorsque l'on donne aux LLM l'accès à des outils comme les terminaux ou les systèmes de fichiers.
Fonctionnement
Le proxy se place entre l'agent d'IA et les outils MCP, enveloppant les serveurs MCP existants sans nécessiter de réécriture de la configuration. Il peut fonctionner localement en tant que proxy léger ou être déployé en tant que passerelle cloud, avec un modèle Railway disponible pour un déploiement plus facile.
Couches de sécurité
- Moteur de règles/signatures : Contient environ 50 signatures YAML qui détectent les attaques courantes comme les shells inversés, les tentatives SSRF et d'autres menaces évidentes. Cette couche ajoute environ 16 ms de latence.
- Couche de notation sémantique (optionnelle) : Lorsque les requêtes semblent suspectes mais pas clairement malveillantes, elles peuvent être évaluées par un petit LLM (Ollama ou OpenAI) qui évalue l'intention.
- Surveillance comportementale : Bloque les modèles anormaux, comme un agent tentant de lire des centaines de fichiers en peu de temps.
Capacités d'audit
Chaque requête bloquée est enregistrée dans un journal d'audit immuable qui est signé cryptographiquement et stocké localement, fournissant un enregistrement vérifiable de ce qui a été bloqué et pourquoi.
L'outil a été développé pour répondre à des préoccupations de sécurité spécifiques avec les implémentations MCP, y compris l'injection de prompts, le parcours de chemins et la suppression accidentelle de répertoires par les agents d'IA.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Blocage Essentiel des Fichiers pour les Assistants de Codage IA : Une Liste de Contrôle de Sécurité Pratique
Les assistants de codage IA lisent depuis votre disque local, pas seulement depuis votre dépôt, exposant des fichiers que .gitignore protège de GitHub mais pas de l'agent. Une discussion Reddit identifie les fichiers critiques à bloquer, y compris les configurations d'assistant IA avec des clés API, les identifiants de service, les clés SSH et les fichiers d'environnement.

Titre de l'article : Sécurité OpenClaw : La ligne de base renforcée par laquelle vous devriez commencer
Héberger soi-même OpenClaw ne le rend pas automatiquement sécurisé. Un post Reddit détaille la configuration de base renforcée : Gateway locale uniquement, isolation DM par pair, groupes d'outils runtime/fs/automatisation interdits, exec verrouillé, et groupes avec mention obligatoire.

Publicité Google malveillante ciblant l'installation du code Claude
Une publicité Google malveillante apparaît comme premier résultat pour les recherches 'install claude code', tentant de tromper les utilisateurs pour qu'ils exécutent des commandes terminal suspectes. La publicité était toujours active au 15 mars 2026, et l'auteur a évité de justesse d'exécuter le code.

Injection d'autorité d'outil dans les agents LLM : quand la sortie de l'outil prime sur l'intention du système
Un chercheur démontre une 'Injection d'Autorité d'Outil' dans un laboratoire d'agent LLM local, montrant comment la sortie d'outil de confiance peut être élevée au niveau d'autorité politique, modifiant silencieusement le comportement de l'agent tandis que le sandbox et l'accès aux fichiers restent sécurisés.