Grupo de Inteligencia de Amenazas de Google reporta el primer exploit de día cero desarrollado por IA que evade la 2FA
El Grupo de Inteligencia de Amenazas de Google (GTIG) ha publicado un informe que detalla una tendencia preocupante: los atacantes ahora utilizan IA en casi todas las áreas del cibercrimen, incluido el desarrollo desde cero de al menos un exploit de día cero. El exploit en cuestión es un script de Python que elude la autenticación de dos factores (2FA) en una popular herramienta de administración de sistemas basada en web y código abierto. Según GTIG, el código muestra "todas las características del uso de IA" y abusa de una falla lógica en el flujo de autorización.
GTIG señala que, si bien los LLM actuales todavía "tienen dificultades para navegar por la lógica empresarial compleja", sobresalen en el razonamiento contextual. Esta capacidad les permite leer el código fuente, validar la intención del desarrollador frente a la implementación real e identificar rápidamente casos límite no considerados que conducen a vulnerabilidades.
El informe también destaca otras aplicaciones maliciosas de IA:
- Malware auto-mutante: Malware que puede modificar su propio código fuente, crear cargas útiles de exploits dinámicamente e incluso generar código señuelo para evadir la detección.
- Puertas traseras impulsadas por Gemini: Los atacantes están aprovechando el modelo Gemini de Google para crear puertas traseras, aunque los detalles de implementación específicos aún no se han revelado.
Los hallazgos sugieren una nueva era del cibercrimen en la que la IA automatiza no solo la entrega de exploits, sino también el descubrimiento y la creación de vulnerabilidades. El exploit de día cero es particularmente notable, ya que marca el primer caso registrado de un exploit desarrollado completamente por IA que elude la 2FA.
Para los equipos de seguridad, esto subraya la necesidad de asumir que la 2FA por sí sola es insuficiente contra adversarios aumentados por IA. Las fallas lógicas en los flujos de autenticación, especialmente en herramientas de código abierto, serán cada vez más objetivo. Los procesos de revisión de código deberían incorporar comprobaciones de razonamiento automatizadas para detectar dichas fallas antes de la implementación.
📖 Read the full source: HN AI Agents
👀 Ver también

Falso sitio de Claude Code distribuyó troyano — detectado por Windows Defender como Trojan:Win32/Kepavll!rfn
Un sitio de typosquatting o basado en anuncios que imita el sitio web oficial de Claude Code distribuyó un troyano detectado como Trojan:Win32/Kepavll!rfn por Windows Defender. Un usuario de Reddit advierte a otros que verifiquen las URL antes de ejecutar comandos de instalación de PowerShell.

Experimento de Auditoría de Seguridad Muestra que el Rendimiento del Agente de IA Depende del Acceso al Conocimiento
Un desarrollador realizó tres auditorías de seguridad en la misma base de código Next.js utilizando diferentes enfoques de IA: la revisión incorporada de Claude Code encontró 1 crítica, 6 altas, 13 medias; un agente de IA sin contexto adicional encontró 1 crítica, 5 altas, 14 medias; un agente de IA con 10 libros profesionales de seguridad encontró 8 críticas, 9 altas, 10 medias.

SupraWall MCP Plugin Bloquea Ataques de Inyección de Comandos en Agentes de IA Locales
SupraWall es un complemento MCP que intercepta y bloquea intentos de exfiltración de datos sensibles de agentes de IA, demostrado en un desafío de equipo rojo donde evitó filtraciones de credenciales mediante ataques de inyección de prompts.

La Descubierta de Vulnerabilidades de IA Supera los Tiempos de Implementación de Parches
Un experto en seguridad argumenta que las herramientas de IA como Mythos encontrarán vulnerabilidades más rápido de lo que se puedan implementar las correcciones, citando datos de Log4j que muestran tiempos promedio de remediación de 17 días y un plazo de eliminación de una década.