BlindKey : Injection d'Informations d'Identification Aveugle pour les Agents IA

✍️ OpenClawRadar📅 Publié: April 13, 2026🔗 Source
BlindKey : Injection d'Informations d'Identification Aveugle pour les Agents IA
Ad

Fonctionnement de BlindKey

BlindKey répond au risque de sécurité lié à la manipulation des identifiants API en texte clair par les agents d'IA. Au lieu de donner aux agents un accès direct aux secrets, il utilise un système où les agents font référence à des jetons de coffre-fort chiffrés (par exemple, bk://stripe). Un proxy local intercepte ces références et injecte l'identifiant réel au moment où la requête API est effectuée. Le processus de l'agent ne voit ni ne stocke jamais le secret en texte clair.

Fonctionnalités de sécurité

  • Chiffrement AES-256-GCM pour les données au repos
  • Liste blanche de domaines par secret (par exemple, une clé Stripe ne peut être utilisée qu'avec api.stripe.com)
  • Verrouillage du système de fichiers par refus par défaut
  • Analyse de contenu sur les écritures de l'agent pour détecter les identifiants ou données personnelles divulgués accidentellement
  • Journal d'audit résistant à la falsification avec chaîne de hachage cryptographique
Ad

Modèle de menace et surface d'attaque

La principale vulnérabilité identifiée est si un agent peut lire la mémoire du processus de BlindKey lui-même ou le fichier du coffre-fort, ce qui contournerait la protection d'injection aveugle. Les mesures d'atténuation actuelles incluent le chiffrement SQLite et les permissions de fichiers au niveau du système d'exploitation. La source suggère qu'un sandboxing au niveau du noyau (comme l'approche de nono) offrirait une protection plus forte.

L'outil est disponible sur GitHub à github.com/michaelkenealy/blindkey.

📖 Read the full source: r/openclaw

Ad

👀 See Also

L'attaque FlyTrap utilise des parapluies adversariaux pour compromettre les drones autonomes basés sur la caméra.
Security

L'attaque FlyTrap utilise des parapluies adversariaux pour compromettre les drones autonomes basés sur la caméra.

Des chercheurs de l'UC Irvine ont développé FlyTrap, un cadre d'attaque physique qui utilise des parapluies peints pour exploiter les vulnérabilités des systèmes de suivi de cibles autonomes basés sur caméra. L'attaque réduit les distances de suivi à des niveaux dangereux, permettant la capture de drones, des attaques de capteurs ou des collisions physiques.

OpenClawRadar
Blocage Essentiel des Fichiers pour les Assistants de Codage IA : Une Liste de Contrôle de Sécurité Pratique
Security

Blocage Essentiel des Fichiers pour les Assistants de Codage IA : Une Liste de Contrôle de Sécurité Pratique

Les assistants de codage IA lisent depuis votre disque local, pas seulement depuis votre dépôt, exposant des fichiers que .gitignore protège de GitHub mais pas de l'agent. Une discussion Reddit identifie les fichiers critiques à bloquer, y compris les configurations d'assistant IA avec des clés API, les identifiants de service, les clés SSH et les fichiers d'environnement.

OpenClawRadar
Recherche : Les caractères Unicode invisibles peuvent détourner les agents LLM via l'accès aux outils
Security

Recherche : Les caractères Unicode invisibles peuvent détourner les agents LLM via l'accès aux outils

Une étude a testé si les LLM suivent des instructions cachées dans des caractères Unicode invisibles intégrés dans du texte normal, en utilisant deux schémas d'encodage sur cinq modèles et 8 308 sorties évaluées. Résultat clé : l'accès aux outils amplifie la conformité de moins de 17 % à 98-100 %, les modèles écrivant des scripts Python pour décoder les caractères cachés.

OpenClawRadar
Hébergez en toute sécurité OpenClaw sur un VPS avec Tailscale et plus
Security

Hébergez en toute sécurité OpenClaw sur un VPS avec Tailscale et plus

Configurez OpenClaw de manière sécurisée sur un VPS en utilisant Tailscale, fail2ban, UFW et plus encore, évitant l'exposition publique et renforçant la défense.

OpenClawRadar