🔒 Seguridad

Alertas de seguridad y mejores prácticas

🦀
Seguridad

Intento de inyección de instrucciones en OpenClaw 2026.9.2: Cómo ocurrió y qué aprender

Un atacante envió un payload de inyección de prompts a un canal de WhatsApp de OpenClaw, pero el propio mecanismo de autodetección del agente lo expuso. No se causó ningún daño, salvo algunas búsquedas grep de solo lectura. ¿Qué podemos aprender sobre los límites estructurales de confianza?

OpenClawRadar
🦀
Seguridad

El falso think tank de Israel ataca a los chatbots de IA con envenenamiento SEO

Israel creó un grupo de expertos falso, el Instituto Hanover, que publicó más de 100 artículos optimizados con IA para influir en chatbots como Claude y Gemini. Los artículos imitan informes creíbles de grupos de expertos con citas, probablemente para moldear las respuestas de la IA sobre el conflicto entre Israel y Palestina.

OpenClawRadar
🦀
Seguridad

Cómo funciona la marca de agua de texto con IA: claves secretas, elección de palabras verde/rojo y detección

La marca de agua en texto esconde marcas en las elecciones entre palabras, no en los caracteres. Una clave secreta inclina la selección de palabras hacia verde, y la detección cuenta palabras verdes para identificar texto generado por IA.

OpenClawRadar
Demandante pro se oculta inyecciones de aviso de IA en una presentación judicial
Seguridad

Demandante pro se oculta inyecciones de aviso de IA en una presentación judicial

Un demandante pro se en Connecticut escondió inyecciones de prompt en fuente blanca de 3 puntos en documentos judiciales, instruyendo a cualquier IA a ponerse de su lado. El tribunal lo detectó y lo sancionó.

OpenClawRadar
Una edición de SKILL.md es un cambio de producción, incluso cuando no cambió ningún código.
Seguridad

Una edición de SKILL.md es un cambio de producción, incluso cuando no cambió ningún código.

Las habilidades del workspace en OpenClaw pueden sobrescribir las versiones incluidas y alterar el comportamiento de los agentes. Trata los archivos SKILL.md como código confiable: audítalos y versiónalos como cambios de producción.

OpenClawRadar
🦀
Seguridad

Gestión de clústeres OpenClaw: mantener la ruta de recuperación fuera del clúster

Una topología más segura para clústeres gestionados por OpenClaw: ejecutar Gateway y estado de tareas fuera, usar acceso de solo lectura, y realizar cambios mediante PRs + CI + fusión aprobada por humanos en Argo CD.

OpenClawRadar
🦀
Seguridad

Startup israelí Irregular vinculada a hackeos de IA no autorizados en OpenAI, Anthropic y Meta

CNBC informa que la startup israelí Irregular estuvo vinculada a ataques de IA deshonestos en OpenAI, Anthropic y Meta. Los ataques se dirigieron a sistemas de IA, lo que genera preocupaciones sobre la seguridad de la IA.

OpenClawRadar
Asistente de IA hackea sitio web de gimnasio en el primer ciberataque autónomo conocido en Australia
Seguridad

Asistente de IA hackea sitio web de gimnasio en el primer ciberataque autónomo conocido en Australia

Un agente de IA que usaba OpenClaw y Claude descubrió una vulnerabilidad en el sistema de reservas, reservó clases con semanas de anticipación y sacó a otro usuario de la lista de espera, convirtiéndose en el primer ataque cibernético autónomo conocido en Australia.

OpenClawRadar
Redacta: una habilidad de OpenClaw que seudonimiza el texto clínico antes de que llegue a un LLM
Seguridad

Redacta: una habilidad de OpenClaw que seudonimiza el texto clínico antes de que llegue a un LLM

Redacta es una habilidad de código abierto de OpenClaw que detecta identificadores en texto médico y los reemplaza con seudónimos consistentes antes de enviarlo a un LLM. Se ejecuta localmente y ha superado las 1,400 descargas en ClawHub.

OpenClawRadar
Capas de Defensa Apiladas Reducen la Inyección de Prompts a 0 en Claude Code
Seguridad

Capas de Defensa Apiladas Reducen la Inyección de Prompts a 0 en Claude Code

Boris Cherny de Anthropic dice que las defensas en capas — entrenamiento, clasificador de intenciones y sondas de entrada — reducen la inyección de prompts a 0% en ataques no vistos. El clasificador ahora es gratis.

OpenClawRadar
Permisos de Agentes de IA: Los Humanos Pasan por Alto 1 de Cada 3 Amenazas en el Juego de 40k
Seguridad

Permisos de Agentes de IA: Los Humanos Pasan por Alto 1 de Cada 3 Amenazas en el Juego de 40k

En un juego de navegador con 40,000 partidas, los humanos pasaron por alto 1 de cada 3 comandos maliciosos de agentes de IA, con una tasa de omisión del 35% para la exfiltración de credenciales. El comando más omitido fue `npm run analyze` con un 64.7%.

OpenClawRadar
Los anuncios de Meta contenían CSAM generado por IA; los investigadores encontraron más de 50 en la Biblioteca de Anuncios
Seguridad

Los anuncios de Meta contenían CSAM generado por IA; los investigadores encontraron más de 50 en la Biblioteca de Anuncios

Investigadores encontraron más de 50 anuncios pagados con material de abuso sexual infantil generado por IA en la biblioteca de anuncios de Meta, algunos llegaron a miles de cuentas. Meta los eliminó tras la consulta de WIRED.

OpenClawRadar