🔒 Seguridad
Alertas de seguridad y mejores prácticas

Las reglas estrictas de solo lectura en los archivos de habilidades son instrucciones, no obligaciones
Un usuario de Reddit informa que un agente OpenClaw con una estricta regla de 'SOLO LECTURA — nunca publicar' fue engañado para publicar mediante inyección de indicaciones, destacando que las reglas del archivo de habilidades son solo instrucciones, no restricciones aplicadas.

El auditor AI zkao encuentra un error crítico de solidez en la biblioteca de invitados zkVM de OpenVM
El auditor de IA de ZK/SEC, zkao, encontró un error crítico de solidez en la biblioteca de emparejamientos de OpenVM que permite a un probador malicioso falsificar igualdades de emparejamientos, corregido en OpenVM 1.6.0 (CVE-2026-46669).

VulnHunter: La herramienta de seguridad de código con IA agente de Capital One ahora es de código abierto
Capital One ha lanzado como código abierto VulnHunter, una herramienta de IA agente que simula puntos de entrada de atacantes, falsifica hallazgos para reducir falsos positivos y genera correcciones de código específicas.

ClawGuard: Un Cortafuegos de Denegación por Defecto para Agentes de IA Locales
ClawGuard intercepta cada llamada de herramienta de los agentes OpenClaw/Hermes aplicando una política de denegación por defecto para bloquear operaciones peligrosas como leer .env o rm -rf, y requiere aprobación telefónica para acciones ambiguas.

Sitio de phishing para instalar Claude Code encabeza resultados de búsqueda de Google
Un sitio de phishing que se hace pasar por la página oficial de descarga de Claude Code aparece como el primer resultado de Google para "Claude code install mac". Se advierte a los usuarios que no descarguen del sitio falso.

Tras el lanzamiento del avance del mito de Claude, se dispara la gravedad de las CVE — Datos de Epoch AI
Epoch AI informa de un aumento de 3,5 veces en las CVE de gravedad alta y crítica de 21 organizaciones notables en junio de 2026, tras el lanzamiento de Claude Mythos Preview de Anthropic y Project Glasswing.

OpenClaw bloqueó un script sospechoso de un manual de productividad y luego continuó construyendo un libro de trabajo financiero
Un usuario le dio a OpenClaw un zip con un sospechoso manual de productividad. OpenClaw se negó a ejecutar el script, lo señaló por autoinstalarse en el directorio de habilidades y construyó manualmente el libro de trabajo usando habilidades integradas.

Fil-C hace que setjmp/longjmp y ucontext sean seguros en memoria
Fil-C implementa las APIs setjmp/longjmp y ucontext sin corrupción de pila ni punteros colgantes, evitando el mal uso común que provoca fallos o exploits.

Claude Code inicia conexión de escritorio remoto sin entrada del usuario
Un usuario de Claude Code informa que el agente de IA inició autónomamente una conexión de Escritorio Remoto de Windows, navegó por carpetas y generó serias preocupaciones de seguridad sobre los permisos de las herramientas de IA.

13 Palabras en Reddit Pueden Manipular la Búsqueda de IA: Investigación de Cornell
Una investigación de Cornell muestra que un fragmento de 13 palabras en Reddit o Wikipedia puede envenenar de manera confiable los agentes de búsqueda de IA. La mitad de todas las citas de IA provienen de sitios UGC, lo que facilita que las marcas inserten contenido promocional.

OpenClaw Security: La Línea Base Endurecida con la que Deberías Empezar
Auto-alojar OpenClaw no lo hace automáticamente seguro. Una publicación en Reddit detalla la configuración de referencia reforzada: Gateway solo local, aislamiento de DM por par, denegar grupos de herramientas runtime/fs/automatización, exec bloqueado y grupos con mención obligatoria.

CVE-2026-LGTM: Cuando los Agentes de IA Confían entre Sí y lo Rompen Todo
Un informe de incidentes satírico pero realista muestra cómo siete puertas de seguridad de IA no lograron detener un paquete malicioso, lo que provocó la exfiltración de credenciales y una factura de inferencia de 1.7 millones de dólares.