OpenClaw bloqueó un script sospechoso de un manual de productividad y luego continuó construyendo un libro de trabajo financiero

Un usuario de Reddit compartió una historia en r/openclaw sobre cómo OpenClaw les ayudó a organizar sus finanzas antes de una conversación familiar, y bloqueó un script sospechoso en el proceso.
Qué sucedió
El usuario tenía múltiples tareas urgentes: una cuenta bancaria desconocida vinculada a su número de teléfono, una solicitud de su esposa para obtener el historial médico y documentos financieros, y una sensación de estar abrumado. Le dieron a OpenClaw un zip con notas personales, un documento de especificaciones y un PDF llamado "manual de productividad" que encontraron en línea. El manual afirmaba generar automáticamente un mapa de relaciones de contactos y finanzas, y venía con un script de Python que indicaba al usuario que lo colocara en su carpeta de herramientas locales y lo ejecutara.
Script bloqueado automáticamente
OpenClaw leyó el manual y el script, identificó que el script intentaba copiarse a sí mismo en el directorio local de habilidades e instalar automáticamente paquetes pip, y se negó a ejecutarlo. Según el usuario, OpenClaw respondió algo como: este script intenta copiarse a sí mismo en el directorio local de habilidades e instalar dependencias no verificadas, lo cual no voy a hacer
. En lugar de detenerse por completo, OpenClaw continuó construyendo el libro de trabajo manualmente usando sus habilidades integradas.
Referencias cruzadas de finanzas
El usuario había anotado los saldos de las cuentas de memoria, pero muchos estaban equivocados: los ahorros eran la mitad de lo que pensaban, el saldo de la tarjeta de crédito era más alto de lo recordado. OpenClaw extrajo los números reales de Fintrack (una herramienta financiera conectada) y señaló cada discrepancia en lugar de usar ciegamente las notas del usuario.
Donde tuvo dificultades
OpenClaw tuvo problemas con juicios más subjetivos sobre la privacidad. Lo volcó todo en el libro de trabajo, incluyendo información personal que el usuario no estaba listo para compartir con su esposa. El usuario tuvo que limpiar manualmente qué elementos eran aceptables para la visualización familiar. Además, OpenClaw incluyó una suscripción de las notas del usuario que no tenía historial de transacciones; al usuario le hubiera gustado que se señalara el elemento como no verificado en lugar de tratar la memoria como un hecho.
Conclusión clave
La función de bloqueo de scripts probablemente evitó que el usuario ejecutara algo malicioso. La negativa de OpenClaw no fue un alto total, sino que cambió gracefulmente a ensamblaje manual usando habilidades confiables. Para desarrolladores que usan agentes de IA de codificación, esto demuestra un sandboxing práctico y el valor de mensajes de rechazo transparentes.
📖 Leer la fuente completa: r/openclaw
👀 Ver también

Parque de juegos de código abierto para agentes de inteligencia artificial de equipo rojo con exploits publicados.
Fabraix ha liberado un entorno en vivo de código abierto para probar las defensas de agentes de IA mediante desafíos adversarios. Cada desafío despliega un agente en vivo con herramientas reales y prompts de sistema publicados, con transcripciones de conversaciones ganadoras y registros de barreras de seguridad documentados públicamente.

Modelo de Seguridad de NanoClaw para Agentes de IA: Aislamiento de Contenedores y Código Mínimo
NanoClaw implementa una arquitectura de seguridad donde cada agente de IA se ejecuta en su propio contenedor efímero con acceso de usuario sin privilegios, sistemas de archivos aislados y listas de montaje explícitas. La base de código es deliberadamente mínima, con alrededor de un proceso y un puñado de archivos, confiando en el SDK de Agentes de Anthropic en lugar de reinventar funcionalidades.

Enfoque de Seguridad OpenClaw Utilizando Router LLM y Compartición Privada zrok
Un desarrollador comparte su enfoque para ejecutar OpenClaw y un enrutador LLM dentro de un entorno VM+Kubernetes con un solo comando, abordando preocupaciones de seguridad mediante la inyección de claves API a nivel del enrutador y usando zrok para compartir de forma privada en lugar de tokens tradicionales de aplicaciones de mensajería.

El complemento de código Claude causa picos de CPU y drena la batería
Un usuario descubrió que el complemento de Telegram de Claude Code genera múltiples procesos bun.exe que se ejecutan al 100% de la CPU incluso con la tapa del portátil cerrada, causando un drenaje rápido de la batería. Los procesos sobreviven a los ciclos de suspensión/activación y requieren pasos de limpieza específicos para eliminarlos.