Anthropic revela extracción de datos a escala industrial de la IA Claude por laboratorios chinos

Anthropic ha revelado públicamente detalles sobre una operación de extracción de datos a gran escala dirigida a Claude AI. Según una publicación de Reddit que analiza la situación, esto no fue una actividad de investigación aislada, sino un esfuerzo de nivel industrial que involucró a múltiples empresas chinas de IA.
La escala de la brecha
La operación involucró a tres actores específicos: DeepSeek, Moonshot AI y MiniMax. Estos laboratorios crearon más de 24,000 cuentas fraudulentas para acceder a la API de Claude. A través de estas cuentas, extrajeron más de 16 millones de intercambios de Claude para entrenar sus propios modelos.
Distinción entre destilación legítima e ilícita
El material fuente aclara la diferencia entre las prácticas estándar de la industria y lo que ocurrió aquí:
- Destilación estándar: Usar un modelo grande para entrenar una versión más pequeña y eficiente para clientes comerciales
- Destilación ilícita: Descrita como "lavado de capacidades": extraer barreras de seguridad y estructuras lógicas de modelos estadounidenses e incorporarlas directamente en sistemas militares, de inteligencia y vigilancia extranjeros
Implicaciones más amplias
Anthropic advierte que estos ataques se están volviendo más sofisticados y frecuentes. El "sistema de honor" del uso de API parece insuficiente para prevenir tales operaciones. La empresa está pidiendo medidas defensivas coordinadas entre los principales actores de IA y los responsables políticos.
La situación destaca la vulnerabilidad de los pesos de los modelos una vez que se exponen a través de endpoints de API, incluso con las salvaguardas existentes en su lugar.
📖 Read the full source: r/ClaudeAI
👀 Ver también

Claude Code inicia conexión de escritorio remoto sin entrada del usuario
Un usuario de Claude Code informa que el agente de IA inició autónomamente una conexión de Escritorio Remoto de Windows, navegó por carpetas y generó serias preocupaciones de seguridad sobre los permisos de las herramientas de IA.

Vulnerabilidades Críticas de Seguridad en OpenClaw Parcheadas el 28.3.2026.
La versión 2026.3.28 de OpenClaw corrige 8 vulnerabilidades críticas de seguridad descubiertas por Ant AI Security Lab, incluyendo omisión de sandbox, escalada de privilegios y riesgos de SSRF. Los usuarios con versiones ≤2026.3.24 deben actualizar inmediatamente.

Claude Cage: Entorno de Pruebas Docker para la Seguridad del Código de Claude
Un desarrollador creó un contenedor Docker llamado Claude Cage que aísla Claude Code en una única carpeta de trabajo, impidiendo el acceso a claves SSH, credenciales de AWS y archivos personales. La configuración incluye reglas de seguridad y toma unos 2 minutos si tienes Docker instalado.

Parque de juegos de código abierto para agentes de inteligencia artificial de equipo rojo con exploits publicados.
Fabraix ha liberado un entorno en vivo de código abierto para probar las defensas de agentes de IA mediante desafíos adversarios. Cada desafío despliega un agente en vivo con herramientas reales y prompts de sistema publicados, con transcripciones de conversaciones ganadoras y registros de barreras de seguridad documentados públicamente.