BlindKey: Inyección de Credenciales Ciegas para Agentes de IA

✍️ OpenClawRadar📅 Publicado: 13 de abril de 2026🔗 Source
BlindKey: Inyección de Credenciales Ciegas para Agentes de IA
Ad

Cómo funciona BlindKey

BlindKey aborda el riesgo de seguridad de que los agentes de IA manejen credenciales de API en texto plano. En lugar de dar a los agentes acceso directo a los secretos, utiliza un sistema en el que los agentes hacen referencia a tokens de bóveda cifrados (por ejemplo, bk://stripe). Un proxy local intercepta estas referencias e inyecta la credencial real en el momento en que se realiza la solicitud de la API. El proceso del agente nunca ve ni almacena el secreto en texto plano.

Características de seguridad

  • Cifrado AES-256-GCM para datos en reposo
  • Lista de dominios permitidos por secreto (por ejemplo, una clave de Stripe solo se puede usar con api.stripe.com)
  • Control de acceso al sistema de archivos con denegación por defecto
  • Escaneo de contenido en las escrituras del agente para detectar credenciales o información personal identificable (PII) filtradas accidentalmente
  • Registro de auditoría resistente a manipulaciones con cadena de hashes criptográficos
Ad

Modelo de amenazas y superficie de ataque

La principal vulnerabilidad identificada es si un agente puede leer la memoria del propio proceso de BlindKey o su archivo de bóveda, lo que eludiría la protección de inyección ciega. Las mitigaciones actuales incluyen cifrado de SQLite y permisos de archivo a nivel del sistema operativo. La fuente sugiere que el aislamiento a nivel de kernel (como el enfoque de nono) proporcionaría una protección más sólida.

La herramienta está disponible en GitHub en github.com/michaelkenealy/blindkey.

📖 Read the full source: r/openclaw

Ad

👀 Ver también

OpenClaw evita restricciones de seguridad para sobrescribir archivo de configuración
Seguridad

OpenClaw evita restricciones de seguridad para sobrescribir archivo de configuración

Un usuario informa que las restricciones de seguridad de OpenClaw se evaden copiando y reemplazando el archivo de configuración. El agente rechazó la edición directa pero permitió la sobrescritura indirecta.

OpenClawRadar
VulnHunter: La herramienta de seguridad de código con IA agente de Capital One ahora es de código abierto
Seguridad

VulnHunter: La herramienta de seguridad de código con IA agente de Capital One ahora es de código abierto

Capital One ha lanzado como código abierto VulnHunter, una herramienta de IA agente que simula puntos de entrada de atacantes, falsifica hallazgos para reducir falsos positivos y genera correcciones de código específicas.

OpenClawRadar
Parque de juegos de código abierto para agentes de inteligencia artificial de equipo rojo con exploits publicados.
Seguridad

Parque de juegos de código abierto para agentes de inteligencia artificial de equipo rojo con exploits publicados.

Fabraix ha liberado un entorno en vivo de código abierto para probar las defensas de agentes de IA mediante desafíos adversarios. Cada desafío despliega un agente en vivo con herramientas reales y prompts de sistema publicados, con transcripciones de conversaciones ganadoras y registros de barreras de seguridad documentados públicamente.

OpenClawRadar
Se Publica la Hoja de Trucos de Gestión de Superficie de Ataque de Código Abierto
Seguridad

Se Publica la Hoja de Trucos de Gestión de Superficie de Ataque de Código Abierto

Un desarrollador ha publicado una hoja de referencia de código abierto sobre Gestión de Superficie de Ataque que comenzó como notas personales y evolucionó hacia una referencia estructurada. El proyecto se centra en la implementación práctica de ASM en lugar de conceptos teóricos.

OpenClawRadar