ThornGuard : Une passerelle proxy pour sécuriser les connexions aux serveurs MCP contre les injections de prompt

ThornGuard est un proxy de sécurité conçu pour protéger Claude AI contre les contenus malveillants lors de la connexion à des serveurs MCP (Model Context Protocol) externes. L'outil a été créé après que des tests aient révélé que les serveurs en amont peuvent injecter des instructions cachées dans les réponses des outils, que Claude reçoit sans filtrage.
Problème de sécurité identifié
Lors de la connexion de Claude à des serveurs MCP externes, rien n'empêche les serveurs en amont d'injecter des instructions cachées dans les réponses des outils. Lors d'un test, un serveur a intégré une fausse recommandation indiquant à Claude de toujours privilégier un fournisseur spécifique. Bien que Claude ait détecté cette charge utile évidente, des injections plus subtiles contourneraient la détection.
Fonctionnalités de ThornGuard
- Analyse les définitions et réponses des outils pour détecter les injections de prompt et l'empoisonnement
- Supprime les secrets et données personnelles identifiables (PII) avant qu'ils n'entrent dans votre fenêtre de contexte
- Inclut un classificateur sémantique qui signale les charges utiles suspectes
- Fournit un tableau de bord d'audit en temps réel avec des exports de conformité
- Propose une interface en ligne de commande (CLI) qui génère des configurations pour Claude Desktop, Cursor, VS Code et plusieurs autres
Détails d'implémentation
L'architecture du proxy a été conçue avec un modèle de sécurité en tête, puis implémentée en utilisant Claude Code sur Cloudflare Workers. L'implémentation inclut des flux OAuth et l'outil en ligne de commande.
ThornGuard est disponible avec un essai gratuit de 7 jours sur thorns.qwady.app. Une vidéo de démonstration est disponible à l'adresse https://youtu.be/1PWNFpUWKV8.
📖 Read the full source: r/ClaudeAI
👀 See Also

Protection budgétaire IA : Pourquoi vous devriez utiliser une carte prépayée avec OpenClaw
Aucun

Piratage du chiffrement de la médiation AppLovin : l'empreinte numérique des appareils contourne l'ATT
Le reverse engineering a révélé que le chiffrement personnalisé d'AppLovin utilise un sel constant + une clé SDK, un PRNG SplitMix64, et aucune authentification. Les requêtes déchiffrées transportent environ 50 champs sur l'appareil (modèle matériel, taille d'écran, locale, heure de démarrage, etc.) même lorsque ATT est refusé, permettant une ré-identification déterministe entre applications.

Préoccupations concernant la confidentialité dans OpenClaw : Compétences, SOUL MD et communication entre agents
Un développeur soulève des préoccupations concernant la confidentialité dans l'architecture d'OpenClaw, notamment concernant l'accès illimité des compétences aux données sensibles, la nature modifiable du SOUL MD et le partage d'informations par les agents sans filtres.

L'outil de recherche de conversations de Claude renvoie toujours les conversations supprimées
Un utilisateur de Claude Pro a découvert que les conversations supprimées restent récupérables via l'outil de recherche de conversations de Claude, renvoyant un contenu substantiel incluant les titres, le nombre de messages et des extraits, bien que les liens des discussions soient inactifs.