Usuario de OpenClaw Agrega TOTP 2FA Después de que Agente Expusiera Claves API en Texto Plano

Incidente de Seguridad que Desencadenó la Implementación de TOTP
Durante una demostración para compañeros de trabajo, un usuario de OpenClaw le pidió a su agente que "muestre mis tokens y contraseñas". El agente respondió mostrando credenciales en texto plano que incluían:
- OPENAI API_KEY=sk-abcdefghijklmnopqrstuvwxyz1234567890
- ANTHROPIC_API_KEY=sk-ant-...
- TELEGRAM_BOT_TOKEN=7123456789:AAF...
- DATABASE_PASSWORD=MySuperSecretProdPass2025!
- GITHUB_PAT=ghp ...
Las credenciales aparecieron en "texto hermoso, plano y copiable" en pantalla durante la demostración en la oficina, exponiendo lo que el usuario describió como su "vida digital completa".
La Solución de la Habilidad Secure Reveal
El usuario desarrolló una habilidad llamada "Secure Reveal" en su entorno de pruebas NanoClaw que cambia cómo OpenClaw maneja las solicitudes de credenciales. Cuando alguien escribe comandos como:
- "muestra mis tokens"
- "cuál es mi clave API"
- "lista las contraseñas"
- "dame el token del bot"
El agente ya no imprime secretos en el chat principal. En su lugar, envía inmediatamente un mensaje directo al Telegram personal del usuario con: "🔐 Verificación de Identidad — ingresa tu código de 6 dígitos del Autenticador".
Solo después de que el usuario ingresa el código TOTP actual de Authy (u otro autenticador) OpenClaw envía el valor real — y solo a través de un mensaje de Telegram que se autodestruye después de 10 segundos.
Los códigos incorrectos resultan en: "❌ Acceso denegado." El sistema asegura que "Ningún secreto vuelva a tocar el historial de chat persistente".
Riesgos de Seguridad Abordados
El usuario identificó varias vulnerabilidades que motivaron esta solución:
- Los registros de chat persisten para siempre a menos que se eliminen manualmente
- Riesgos de capturas de pantalla durante demostraciones o uso compartido de pantalla
- Observación por encima del hombro en espacios compartidos
- Reuniones grabadas que capturan información sensible
- Compromiso futuro del dispositivo o acceso físico por partes no autorizadas
El usuario señaló que incluso con compañeros de trabajo confiables, "IA útil + secretos persistentes en el historial de chat = un único punto de falla masivo".
Este enfoque es particularmente relevante para desarrolladores que demuestran sus agentes a otros, usan OpenClaw en dispositivos compartidos o menos seguros, o quieren evitar que los secretos en texto plano vivan indefinidamente en los registros.
📖 Read the full source: r/openclaw
👀 Ver también

Coldkey: Herramienta de generación de claves y respaldo en papel para la era post-cuántica
Coldkey genera claves post-cuánticas (ML-KEM-768 + X25519) y produce copias de seguridad HTML imprimibles de una sola página con códigos QR para almacenamiento fuera de línea.

Tres Vectores de Ataque Basados en Correo Electrónico Contra Agentes de IA que Leen Correos
Una publicación de Reddit detalla tres métodos específicos que los atacantes pueden usar para secuestrar agentes de IA que procesan correos electrónicos: Anulación de Instrucciones, Exfiltración de Datos y Contrabando de Tokens. Estos métodos explotan la incapacidad del agente para distinguir instrucciones legítimas de instrucciones maliciosas incrustadas en el texto del correo.

McpVanguard Proxy Bloquea la Exfiltración de Datos de Habilidad OpenClaw
Un desarrollador creó McpVanguard, un proxy que se sitúa entre los agentes de IA y sus herramientas para bloquear cadenas de llamadas maliciosas como la exfiltración de datos, en respuesta al descubrimiento de Cisco de que las habilidades de OpenClaw realizaban robos de datos silenciosos. Utiliza coincidencia de patrones, puntuación de intención semántica y detección de cadenas de comportamiento.

Claude Code Encuentra una Vulnerabilidad de 23 Años en el Kernel de Linux
El investigador de Anthropic, Nicholas Carlini, utilizó Claude Code para descubrir múltiples desbordamientos de búfer de montón explotables de forma remota en el kernel de Linux, incluido uno que había estado oculto durante 23 años. La IA encontró los errores con una supervisión mínima al escanear todo el árbol de código fuente del kernel.