MCPwner, Herramienta de Pentesting con IA, Encuentra Múltiples Vulnerabilidades 0-Day en OpenClaw

Qué es MCPwner
MCPwner es un servidor MCP (Protocolo de Contexto de Modelo) que permite a los agentes de IA realizar pruebas de penetración automatizadas contra objetivos de seguridad. El desarrollador lo construyó para orquestar modelos de IA más antiguos como GPT-4o y Claude 3.5 Sonnet, que cuando se dirigen adecuadamente a través de MCPwner pueden encontrar fallas arquitectónicas profundas que las herramientas de escaneo estándar pasan por alto.
Hallazgos Recientes en OpenClaw
Cuando se apuntó a OpenClaw, MCPwner identificó con éxito múltiples vulnerabilidades de día cero que ahora han recibido avisos oficiales. Estos no eran solo errores menores, sino problemas críticos de seguridad:
- Inyección de Variables de Entorno
- Omisión de aprobación automática de permisos ACP
- Divulgación de información del oráculo de existencia de archivos
- Omisión de entrada estándar exclusiva de safeBins
La herramienta encontró omisiones lógicas y puntos de inyección que las herramientas tradicionales de análisis estático pasaron por alto por completo.
Enfoque Técnico
MCPwner demuestra que los modelos de IA de nivel medio y más antiguos, cuando se orquestan adecuadamente a través de este servidor MCP, pueden superar al análisis estático tradicional para el descubrimiento de vulnerabilidades. El proyecto ya ha identificado múltiples vulnerabilidades y otros CVEs más allá de los hallazgos de OpenClaw.
Estado del Proyecto y Contribución
El proyecto aún está en desarrollo activo pero ya está produciendo resultados. El desarrollador busca colaboradores para ayudar a afinar la lógica de escaneo y expandir el conjunto de herramientas. Se aceptan solicitudes de extracción y comentarios, especialmente de aquellos que trabajan en el espacio de IA ofensiva y quieren probar la herramienta.
Repositorio de GitHub: https://github.com/Pigyon/MCPwner
📖 Read the full source: r/openclaw
👀 Ver también

Inyección de mensajes en la capa de audio contra Claude: Lo que no está en la transcripción
Un constructor de una API de detección de inyección de prompts comparte hallazgos sobre ataques en la capa de audio contra Claude, revelando que los ataques en la señal (no en la transcripción) son invisibles en los registros y representan una amenaza real para los agentes de voz.

Claude Cage: Entorno de Pruebas Docker para la Seguridad del Código de Claude
Un desarrollador creó un contenedor Docker llamado Claude Cage que aísla Claude Code en una única carpeta de trabajo, impidiendo el acceso a claves SSH, credenciales de AWS y archivos personales. La configuración incluye reglas de seguridad y toma unos 2 minutos si tienes Docker instalado.

Investigación: Los Caracteres Unicode Invisibles Pueden Secuestrar Agentes de LLM a través del Acceso a Herramientas
Un estudio evaluó si los modelos de lenguaje grandes (LLM) siguen instrucciones ocultas en caracteres Unicode invisibles incrustados en texto normal, utilizando dos esquemas de codificación en cinco modelos y 8,308 salidas calificadas. Hallazgo clave: el acceso a herramientas amplifica el cumplimiento de menos del 17% a 98-100%, con modelos escribiendo scripts en Python para decodificar los caracteres ocultos.

Por que las herramientas internas de RAG y doc-chat fallan en auditorias de seguridad
La comunidad discute bloqueadores reales de seguridad y cumplimiento que impiden que las herramientas RAG lleguen a produccion.