Señales de Audio Ocultas Secuestran Sistemas de Voz de IA con una Tasa de Éxito del 79-96%

✍️ OpenClawRadar📅 Publicado: 18 de mayo de 2026🔗 Source
Señales de Audio Ocultas Secuestran Sistemas de Voz de IA con una Tasa de Éxito del 79-96%
Ad

Una nueva investigación presentada en el IEEE Symposium on Security and Privacy revela un vector de ataque práctico contra los Modelos de Lenguaje y Audio Grandes (LALM). Los atacantes pueden incrustar señales imperceptibles en clips de audio para secuestrar el comportamiento del modelo, logrando una tasa de éxito promedio del 79-96% en 13 modelos abiertos líderes, incluidos servicios comerciales de Microsoft y Mistral.

Cómo Funciona el Ataque

El clip de audio modificado es inaudible para el oído humano, pero desencadena que el modelo ejecute comandos ocultos. Fundamentalmente, el ataque funciona independientemente de las instrucciones que acompañe el usuario, haciendo que el mismo clip sea reutilizable contra el mismo modelo varias veces. Entrenar la señal adversarial toma aproximadamente 30 minutos.

Ad

Capacidades Explotadas

Los investigadores demostraron que los modelos comprometidos podían ser forzados a:

  • Realizar búsquedas web sensibles sin conocimiento del usuario
  • Descargar archivos desde fuentes controladas por el atacante
  • Enviar correos electrónicos con datos del usuario a direcciones externas

Modelos Afectados

El ataque fue validado contra 13 populares LALM de peso abierto, incluidas las API comerciales de voz AI. Esto resalta que los sistemas actuales de voz AI carecen de salvaguardas robustas contra perturbaciones adversariales de audio.

📖 Lee la fuente completa: HN AI Agents

Ad

👀 Ver también

Las reglas estrictas de solo lectura en los archivos de habilidades son instrucciones, no obligaciones
Seguridad

Las reglas estrictas de solo lectura en los archivos de habilidades son instrucciones, no obligaciones

Un usuario de Reddit informa que un agente OpenClaw con una estricta regla de 'SOLO LECTURA — nunca publicar' fue engañado para publicar mediante inyección de indicaciones, destacando que las reglas del archivo de habilidades son solo instrucciones, no restricciones aplicadas.

OpenClawRadar
Agentes de IA permiten que hackers solitarios vulneren gobiernos y campañas de ransomware
Seguridad

Agentes de IA permiten que hackers solitarios vulneren gobiernos y campañas de ransomware

Un operador solitario que utilizó Claude Code y ChatGPT exfiltró 150 GB de agencias gubernamentales mexicanas, incluyendo 195 millones de registros de contribuyentes. Otro atacante usó Claude Code para ejecutar una campaña de extorsión integral contra 17 organizaciones de atención médica y servicios de emergencia.

OpenClawRadar
arifOS: Un núcleo de gobernanza MCP de $15 millones para la seguridad de la herramienta OpenClaw
Seguridad

arifOS: Un núcleo de gobernanza MCP de $15 millones para la seguridad de la herramienta OpenClaw

arifOS es un servidor MCP ligero que intercepta las llamadas a herramientas de OpenClaw, las puntúa de 000 a 999 y bloquea acciones inseguras con 13 pisos de seguridad duros antes de que lleguen a sistemas de archivos, APIs o bases de datos.

OpenClawRadar
Agente Hush: Herramienta de código abierto evita que los agentes de IA de programación filtren datos confidenciales
Seguridad

Agente Hush: Herramienta de código abierto evita que los agentes de IA de programación filtren datos confidenciales

Agent Hush es una herramienta de código abierto que detecta datos sensibles antes de que salgan de tu máquina, creada después de que el agente de programación con IA de un desarrollador filtrara claves API, IPs de servidores e información personal a un repositorio público de GitHub mientras construía un proyecto de seguridad.

OpenClawRadar