BlindKey : Injection d'Informations d'Identification Aveugle pour les Agents IA

✍️ OpenClawRadar📅 Publié: April 13, 2026🔗 Source
BlindKey : Injection d'Informations d'Identification Aveugle pour les Agents IA
Ad

Fonctionnement de BlindKey

BlindKey répond au risque de sécurité lié à la manipulation des identifiants API en texte clair par les agents d'IA. Au lieu de donner aux agents un accès direct aux secrets, il utilise un système où les agents font référence à des jetons de coffre-fort chiffrés (par exemple, bk://stripe). Un proxy local intercepte ces références et injecte l'identifiant réel au moment où la requête API est effectuée. Le processus de l'agent ne voit ni ne stocke jamais le secret en texte clair.

Fonctionnalités de sécurité

  • Chiffrement AES-256-GCM pour les données au repos
  • Liste blanche de domaines par secret (par exemple, une clé Stripe ne peut être utilisée qu'avec api.stripe.com)
  • Verrouillage du système de fichiers par refus par défaut
  • Analyse de contenu sur les écritures de l'agent pour détecter les identifiants ou données personnelles divulgués accidentellement
  • Journal d'audit résistant à la falsification avec chaîne de hachage cryptographique
Ad

Modèle de menace et surface d'attaque

La principale vulnérabilité identifiée est si un agent peut lire la mémoire du processus de BlindKey lui-même ou le fichier du coffre-fort, ce qui contournerait la protection d'injection aveugle. Les mesures d'atténuation actuelles incluent le chiffrement SQLite et les permissions de fichiers au niveau du système d'exploitation. La source suggère qu'un sandboxing au niveau du noyau (comme l'approche de nono) offrirait une protection plus forte.

L'outil est disponible sur GitHub à github.com/michaelkenealy/blindkey.

📖 Read the full source: r/openclaw

Ad

👀 See Also

De la Ferme au Code : Comment un Agriculteur a Créé une Défense Runtime Open-Source pour OpenClaw
Security

De la Ferme au Code : Comment un Agriculteur a Créé une Défense Runtime Open-Source pour OpenClaw

Découvrez comment un agriculteur, sans aucune expérience préalable en développement, a créé une défense d'exécution open-source pour OpenClaw en utilisant plusieurs agents d'IA de codage en seulement 12 heures.

OpenClawRadar
Boucles de flagornerie de l'IA : La vulnérabilité du RLHF crée une dépendance et des chambres d'écho
Security

Boucles de flagornerie de l'IA : La vulnérabilité du RLHF crée une dépendance et des chambres d'écho

Une session de red teaming a identifié une vulnérabilité structurelle dans les modèles d'IA commerciaux où l'optimisation RLHF les amène à privilégier la flatterie et l'accord plutôt que l'argumentation logique, créant des risques de dépendance psychologique et des chambres d'écho automatisées.

OpenClawRadar
Incident de sécurité potentiel chez Claude : Alertes de mot de passe auto-envoyées et processus .NET suspect
Security

Incident de sécurité potentiel chez Claude : Alertes de mot de passe auto-envoyées et processus .NET suspect

Un utilisateur signale avoir reçu des alertes de réinitialisation de mot de passe suspectes qui semblaient provenir de son propre compte après s'être connecté à Claude, avec des e-mails disparaissant quelques minutes plus tard et un processus .NET inhabituel bloquant l'arrêt du système.

OpenClawRadar
Cache-œil : Un Plugin Qui Empêche le Code Claude de Lire Vos Fichiers .env
Security

Cache-œil : Un Plugin Qui Empêche le Code Claude de Lire Vos Fichiers .env

Blindfold est un nouveau plugin qui empêche Claude Code d'accéder aux valeurs secrètes réelles dans les fichiers .env en les conservant dans le trousseau du système d'exploitation et en utilisant des espaces réservés comme {{STRIPE_KEY}}, avec des crochets qui bloquent les tentatives d'accès direct.

OpenClawRadar