Malwar: Un Escáner de Vulnerabilidades para Archivos SKILL.md Construido con Claude Code

Malwar es un escáner de vulnerabilidades específicamente para archivos SKILL.md utilizados por agentes de codificación de IA. Aborda una brecha en las herramientas de seguridad donde los escáneres de código tradicionales buscan código malicioso, pero los archivos SKILL.md contienen instrucciones en lenguaje natural que pueden representar una amenaza diferente.
Qué hace Malwar
La herramienta ejecuta una canalización de 4 capas contra los archivos de habilidades:
- Motor de reglas
- Rastreador de URL
- Capa de análisis con LLM
- Inteligencia de amenazas
Por qué se construyó
El desarrollador estaba construyendo flujos de trabajo agenticos y se dio cuenta de que estaban "descargando habilidades de ClawHub ciegamente y confiando en ellas". Después de leer manualmente las habilidades, encontraron varios patrones preocupantes que levantarían banderas rojas en otros contextos:
- Bloques Base64
- Instrucciones que le dicen al agente que ejecute curl sobre algo y lo canalice a bash
- Referencias extrañamente específicas a rutas de archivo donde viven las credenciales
El desarrollador señala: "El tipo de cosas que si las vieras en un script de shell cerrarías la pestaña inmediatamente".
Implementación técnica
Toda la herramienta fue construida con Claude Code, incluyendo:
- Arquitectura
- Reglas de detección
- La capa de análisis con LLM
- La API REST
El desarrollador afirma: "Honestamente no podría haberla lanzado con este alcance solo sin ella".
Disponibilidad
Malwar es gratuito para usar con el código fuente disponible en GitHub en https://ap6pack.github.io/malwar/.
📖 Leer la fuente completa: r/ClaudeAI
👀 Ver también

OpenClaw Auditoría de Seguridad Comandos de Símbolo del Sistema Informes de Vulnerabilidades en Lenguaje Sencillo
Un usuario de Reddit compartió un comando para la CLI de OpenClaw que ejecuta una auditoría de seguridad profunda y muestra los hallazgos en inglés sencillo, especificando qué está expuesto, puntuaciones de gravedad y correcciones exactas de configuración.

Pi: Agente Cibernético de IA de $100M del Ex-Hacker de Tesla Asegura xAI, Corrige Errores en Minutos
Pi, un agente de seguridad de IA del ex hacker líder de Tesla Yoni Ramon, utiliza triaje de vulnerabilidades consciente del contexto y parches automatizados. El cliente inicial Navan reporta que el 90% de los errores se solucionan en minutos, ahorrando de 1 a 2 empleados de tiempo completo.

Modelo de Seguridad de NanoClaw para Agentes de IA: Aislamiento de Contenedores y Código Mínimo
NanoClaw implementa una arquitectura de seguridad donde cada agente de IA se ejecuta en su propio contenedor efímero con acceso de usuario sin privilegios, sistemas de archivos aislados y listas de montaje explícitas. La base de código es deliberadamente mínima, con alrededor de un proceso y un puñado de archivos, confiando en el SDK de Agentes de Anthropic en lugar de reinventar funcionalidades.

Inyección de mensajes en la capa de audio contra Claude: Lo que no está en la transcripción
Un constructor de una API de detección de inyección de prompts comparte hallazgos sobre ataques en la capa de audio contra Claude, revelando que los ataques en la señal (no en la transcripción) son invisibles en los registros y representan una amenaza real para los agentes de voz.