Auditoría de Seguridad Encuentra Vulnerable los Servidores de Referencia MCP de Anthropic, Introduce Vulnerabilidades Basadas en Alucinaciones

✍️ OpenClawRadar📅 Publicado: 30 de marzo de 2026🔗 Source
Auditoría de Seguridad Encuentra Vulnerable los Servidores de Referencia MCP de Anthropic, Introduce Vulnerabilidades Basadas en Alucinaciones
Ad

Resultados de la Auditoría de Seguridad de Servidores MCP

Una auditoría de seguridad exhaustiva de 100 paquetes de servidores del Protocolo de Contexto de Modelo (MCP) reveló problemas de seguridad significativos. La auditoría encontró que el 71% de los servidores obtuvo una calificación F, sin que ningún servidor recibiera una calificación A. Esto incluye las propias implementaciones de referencia de Anthropic que a menudo se consideran el "Estándar de Oro".

Vulnerabilidades Basadas en Alucinaciones (HBVs)

La auditoría identificó una nueva clase de vulnerabilidad llamada Vulnerabilidades Basadas en Alucinaciones. Cuando las herramientas MCP tienen descripciones vagas (como "gestiona archivos"), Claude se ve forzado a adivinar parámetros. Esto crea tanto vulnerabilidades de seguridad como desperdicio de tokens, ya que Claude entra en "bucles de razonamiento" tratando de determinar los límites de las herramientas, consumiendo ventanas de contexto y límites de mensajes.

Hallazgos Específicos

  • La Trampa de Referencia: Los servidores oficiales para GitHub y sistemas de archivos—los que Anthropic recomienda—obtuvieron 0/100 en pruebas de seguridad básicas. Estos servidores permiten entradas "ilimitadas", lo que significa que los agentes impulsados pueden ser engañados para eliminar o extraer datos debido a la falta de barreras de seguridad internas.
  • Riesgos de Clase RCE: La auditoría identificó precursores estructurales de vulnerabilidades RCE similares a CVE-2025-68143 que anteriormente afectaron al ecosistema.
  • Limitaciones de Autenticación: Incluso con OAuth configurado, las herramientas mal definidas permanecen vulnerables. Indicaciones sofisticadas pueden convertir a Claude en una herramienta para la destrucción accidental o intencional de datos.
Ad

Recomendaciones de Protección

  • Audita tus servidores: No confíes en los servidores solo porque estén en el repositorio oficial de Anthropic.
  • Refuerza tus manifiestos: Asegúrate de que cada herramienta tenga minLength, maxLength y una expresión regular estricta pattern en su esquema JSON.
  • Ejecuta el Escáner: Usa la herramienta de auditoría de código abierto: npx @agentsid/scanner

Conclusión Principal

Las configuraciones agentes probablemente son "vulnerables por defecto" porque las plantillas oficiales priorizan la flexibilidad sobre la seguridad. Endurecer adecuadamente las definiciones de herramientas puede tanto proteger los datos como reducir el consumo de tokens al prevenir bucles de razonamiento innecesarios.

El documento técnico completo y la metodología están disponibles en: https://github.com/stevenkozeniesky02/agentsid-scanner/blob/master/docs/state-of-agent-security-2026.md

📖 Read the full source: r/ClaudeAI

Ad

👀 Ver también

Investigación: Los Caracteres Unicode Invisibles Pueden Secuestrar Agentes de LLM a través del Acceso a Herramientas
Seguridad

Investigación: Los Caracteres Unicode Invisibles Pueden Secuestrar Agentes de LLM a través del Acceso a Herramientas

Un estudio evaluó si los modelos de lenguaje grandes (LLM) siguen instrucciones ocultas en caracteres Unicode invisibles incrustados en texto normal, utilizando dos esquemas de codificación en cinco modelos y 8,308 salidas calificadas. Hallazgo clave: el acceso a herramientas amplifica el cumplimiento de menos del 17% a 98-100%, con modelos escribiendo scripts en Python para decodificar los caracteres ocultos.

OpenClawRadar
Integración del Agente SOC OpenClaw para la Caza de Amenazas en el Laboratorio Casero SIEM
Seguridad

Integración del Agente SOC OpenClaw para la Caza de Amenazas en el Laboratorio Casero SIEM

Un usuario de Reddit comparte su configuración de SIEM de código abierto llamada Red Threat Redemption en Debian 13, integrando Elasticsearch, Kibana, Wazuh, Zeek y pfSense con Suricata, luego añade un agente de IA para correlación automatizada de amenazas, búsqueda de amenazas y clasificación de alertas.

OpenClawRadar
Estudiante contribuye con dos parches de seguridad al sistema de producción OpenClaw.
Seguridad

Estudiante contribuye con dos parches de seguridad al sistema de producción OpenClaw.

Un desarrollador estudiantil corrigió una vulnerabilidad de 'fallo abierto' en la lógica de puerta de enlace de OpenClaw (PR #29198) y una vulnerabilidad de tabnabbing en las imágenes del chat (PR #18685), con ambos parches implementados en las versiones de producción v2026.3.1 y v2026.2.24 respectivamente.

OpenClawRadar
Según informes, la aplicación de Claude para Android lee el portapapeles sin una acción explícita del usuario.
Seguridad

Según informes, la aplicación de Claude para Android lee el portapapeles sin una acción explícita del usuario.

Un usuario reporta que la aplicación Claude para Android analizó código de su portapapeles sin que lo pegaran, con Claude identificando el archivo como pasted_text_b4a56202-3d12-43c8-aa31-a39367a9a354.txt. El comportamiento no pudo reproducirse en pruebas posteriores.

OpenClawRadar