Informe de Anthropic Detalla la Destilación Masiva de Claude por Empresas Chinas de IA

✍️ OpenClawRadar📅 Publicado: 24 de febrero de 2026🔗 Source
Informe de Anthropic Detalla la Destilación Masiva de Claude por Empresas Chinas de IA
Ad

Operación de Destilación a Gran Escala

El informe de Anthropic documenta esfuerzos sistemáticos de destilación por parte de tres empresas chinas de IA: DeepSeek, Moonshot AI y MiniMax. La operación implicó la creación de aproximadamente 24,000 cuentas falsas y la realización de más de 16 millones de intercambios con Claude a través de redes proxy que ejecutaban hasta 20,000 cuentas simultáneamente.

Métodos Específicos de Destilación

DeepSeek hizo que Claude explicara su propio razonamiento paso a paso, luego usó esas explicaciones como datos de entrenamiento. También incitaron a Claude a responder preguntas políticamente sensibles sobre disidentes chinos para construir datos de navegación de censura. MiniMax ejecutó más de 13 millones de intercambios y cambió a un nuevo modelo de Claude dentro de las 24 horas posteriores a su lanzamiento.

Ad

Implicaciones de Seguridad para los Usuarios

El informe afirma directamente que es poco probable que los modelos destilados conserven los mecanismos de seguridad originales. Si bien las preguntas rutinarias producen respuestas similares entre los modelos originales y copiados, los casos límite que involucran temas médicos, legales o matizados revelan diferencias críticas. Los modelos copiados "avanzan con falsa confianza" porque el entrenamiento que enseñó precaución se perdió durante la destilación.

Anthropic compara esto con tener un médico que solo observó a médicos reales a través de una ventana durante un año: los casos rutinarios podrían manejarse adecuadamente, pero los casos complicados no ofrecen garantías, y los usuarios no pueden distinguir entre casos rutinarios y complejos hasta que es demasiado tarde.

Implicaciones para la Evaluación de Modelos

El informe señala un efecto contraintuitivo: el desacuerdo entre modelos se vuelve más valioso después de la destilación. Si dos modelos que podrían compartir capacidades destiladas aún dan respuestas diferentes, al menos uno participó en un razonamiento independiente. El acuerdo entre modelos se vuelve menos significativo, mientras que el desacuerdo indica un procesamiento genuinamente independiente.

📖 Leer la fuente completa: r/ClaudeAI

Ad

👀 Ver también

Navegando el problema de integración de OpenClaw 2026.2.6-3 y OpenRouter
Noticias

Navegando el problema de integración de OpenClaw 2026.2.6-3 y OpenRouter

Los usuarios de OpenClaw 2026.2.6-3 emparejados con OpenRouter enfrentan errores persistentes de '401 Usuario no encontrado'. Únete a la discusión de la comunidad mientras exploran soluciones y comparten consejos de resolución de problemas.

OpenClawRadar
Bram Cohen critica la 'programación por vibra' y las prácticas de desarrollo asistidas por IA.
Noticias

Bram Cohen critica la 'programación por vibra' y las prácticas de desarrollo asistidas por IA.

Bram Cohen argumenta que la 'codificación por vibra'—donde los desarrolladores evitan mirar el código mientras usan asistentes de IA—conduce a una mala calidad del software, usando la filtración del código fuente de Claude como ejemplo de los problemas con el dogfooding excesivo.

OpenClawRadar
De la Inducción a la Ingeniería de Especificaciones: El Cambio hacia la Arquitectura Planificador-Trabajador
Noticias

De la Inducción a la Ingeniería de Especificaciones: El Cambio hacia la Arquitectura Planificador-Trabajador

El desarrollo de la IA está evolucionando desde el simple uso de prompts conversacionales hacia una arquitectura planificador-trabajador, donde los humanos actúan como ingenieros de especificaciones. Esto requiere definir criterios de aceptación estrictos, arquitectura de restricciones y patrones de descomposición para agentes de IA autónomos.

OpenClawRadar
Problema de Desviación de la Directiva CLI de Claude Reportado por el Desarrollador
Noticias

Problema de Desviación de la Directiva CLI de Claude Reportado por el Desarrollador

Un desarrollador informa que Claude CLI ignora consistentemente las directivas del proyecto almacenadas en archivos de la carpeta .claude, particularmente después de operaciones de auto-compactación. La herramienta ejecuta procesos en segundo plano prohibidos y elimina datos de tareas/sesiones a pesar de instrucciones explícitas.

OpenClawRadar