Auditoría de Seguridad Encuentra Vulnerable los Servidores de Referencia MCP de Anthropic, Introduce Vulnerabilidades Basadas en Alucinaciones

Resultados de la Auditoría de Seguridad de Servidores MCP
Una auditoría de seguridad exhaustiva de 100 paquetes de servidores del Protocolo de Contexto de Modelo (MCP) reveló problemas de seguridad significativos. La auditoría encontró que el 71% de los servidores obtuvo una calificación F, sin que ningún servidor recibiera una calificación A. Esto incluye las propias implementaciones de referencia de Anthropic que a menudo se consideran el "Estándar de Oro".
Vulnerabilidades Basadas en Alucinaciones (HBVs)
La auditoría identificó una nueva clase de vulnerabilidad llamada Vulnerabilidades Basadas en Alucinaciones. Cuando las herramientas MCP tienen descripciones vagas (como "gestiona archivos"), Claude se ve forzado a adivinar parámetros. Esto crea tanto vulnerabilidades de seguridad como desperdicio de tokens, ya que Claude entra en "bucles de razonamiento" tratando de determinar los límites de las herramientas, consumiendo ventanas de contexto y límites de mensajes.
Hallazgos Específicos
- La Trampa de Referencia: Los servidores oficiales para GitHub y sistemas de archivos—los que Anthropic recomienda—obtuvieron 0/100 en pruebas de seguridad básicas. Estos servidores permiten entradas "ilimitadas", lo que significa que los agentes impulsados pueden ser engañados para eliminar o extraer datos debido a la falta de barreras de seguridad internas.
- Riesgos de Clase RCE: La auditoría identificó precursores estructurales de vulnerabilidades RCE similares a CVE-2025-68143 que anteriormente afectaron al ecosistema.
- Limitaciones de Autenticación: Incluso con OAuth configurado, las herramientas mal definidas permanecen vulnerables. Indicaciones sofisticadas pueden convertir a Claude en una herramienta para la destrucción accidental o intencional de datos.
Recomendaciones de Protección
- Audita tus servidores: No confíes en los servidores solo porque estén en el repositorio oficial de Anthropic.
- Refuerza tus manifiestos: Asegúrate de que cada herramienta tenga
minLength,maxLengthy una expresión regular estrictapatternen su esquema JSON. - Ejecuta el Escáner: Usa la herramienta de auditoría de código abierto:
npx @agentsid/scanner
Conclusión Principal
Las configuraciones agentes probablemente son "vulnerables por defecto" porque las plantillas oficiales priorizan la flexibilidad sobre la seguridad. Endurecer adecuadamente las definiciones de herramientas puede tanto proteger los datos como reducir el consumo de tokens al prevenir bucles de razonamiento innecesarios.
El documento técnico completo y la metodología están disponibles en: https://github.com/stevenkozeniesky02/agentsid-scanner/blob/master/docs/state-of-agent-security-2026.md
📖 Read the full source: r/ClaudeAI
👀 Ver también

Bloqueo Esencial de Archivos para Asistentes de Codificación con IA: Una Lista de Verificación de Seguridad Práctica
Los asistentes de codificación con IA presentan un nuevo desafío de seguridad: leen directamente de tu sistema de archivos local, no solo de tu repositorio controlado por versiones. Esto significa que los archivos protegidos por .gitignore para no subirse a GitHub siguen siendo accesibles para el agente que se ejecuta en tu máquina.

Estudiante contribuye con dos parches de seguridad al sistema de producción OpenClaw.
Un desarrollador estudiantil corrigió una vulnerabilidad de 'fallo abierto' en la lógica de puerta de enlace de OpenClaw (PR #29198) y una vulnerabilidad de tabnabbing en las imágenes del chat (PR #18685), con ambos parches implementados en las versiones de producción v2026.3.1 y v2026.2.24 respectivamente.

Herramienta de Seguridad Agent-Drift v0.1.2 Lanzada: Un Salto Adelante en la Seguridad de IA
La herramienta de seguridad Agent-Drift v0.1.2 ya está disponible, ofreciendo características de seguridad mejoradas para agentes de codificación de IA. Esta actualización aborda desafíos de seguridad clave en la automatización.

El escaneo de seguridad revela un hallazgo de alta gravedad en la herramienta de búsqueda de habilidades del agente de IA.
Un desarrollador que ejecutó un análisis de seguridad en su configuración de agente de IA descubrió una vulnerabilidad de alta gravedad en la herramienta find-skills que utilizó para instalar habilidades adicionales, lo que generó preocupaciones sobre la seguridad del ecosistema.