El modelo de IA Claude Mythos de Anthropic fue revelado en una filtración de datos, descrito como un "cambio radical" en capacidades.

Qué se filtró
Una filtración de datos de un almacén de datos no seguro y públicamente accesible reveló que Anthropic está desarrollando y probando un nuevo modelo de IA llamado Claude Mythos. La filtración incluyó aproximadamente 3.000 activos no publicados vinculados al blog de Anthropic, incluido lo que parecía ser un borrador de publicación de blog anunciando el nuevo modelo.
Detalles del modelo según la fuente
Según los documentos filtrados:
- El modelo se llama "Claude Mythos" y también se conoce como "Capybara", que Anthropic describe como "un nuevo nombre para un nuevo nivel de modelo: más grande e inteligente que nuestros modelos Opus".
- Capybara representa un nuevo nivel por encima de Opus en la jerarquía de modelos de Anthropic (que actualmente incluye Opus como el más grande/más capaz, Sonnet como más rápido/económico y Haiku como el más pequeño/rápido).
- En comparación con Claude Opus 4.6, Capybara obtiene "puntuaciones notablemente más altas en pruebas de codificación de software, razonamiento académico y ciberseguridad, entre otras".
- El borrador de la publicación de blog describe a Claude Mythos como "con diferencia el modelo de IA más potente que hemos desarrollado nunca".
- Anthropic considera este modelo "un cambio radical y el más capaz que hemos construido hasta la fecha".
Estado actual y despliegue
El modelo está actualmente en pruebas con "clientes de acceso anticipado" como parte de una estrategia de despliegue cautelosa. Según el material fuente:
- El modelo es costoso de ejecutar y aún no está listo para su lanzamiento general
- Anthropic está "siendo deliberado sobre cómo lo lanzamos" debido a la potencia de sus capacidades
- La empresa está trabajando con "un pequeño grupo de clientes de acceso anticipado para probar el modelo"
- La filtración también reveló detalles de una cumbre de CEO planificada, solo por invitación, en Europa como parte del impulso de Anthropic para vender modelos de IA a grandes clientes corporativos
Implicaciones de seguridad
El borrador de la publicación de blog indicó que la empresa cree que Claude Mythos "plantea riesgos de ciberseguridad sin precedentes". La filtración en sí resultó de lo que Anthropic describió como "error humano" en la configuración de su sistema de gestión de contenidos, que hizo que el contenido del borrador fuera públicamente accesible.
Contexto para desarrolladores que usan agentes de IA para codificación
Para los desarrolladores que dependen de asistentes de IA para codificación, esta filtración sugiere que pueden llegar mejoras significativas en las capacidades de codificación de Anthropic. La mención específica de "puntuaciones notablemente más altas en pruebas de codificación de software" indica posibles avances que podrían afectar a herramientas y flujos de trabajo que se integran con la API de Claude.
📖 Leer la fuente completa: HN AI Agents
👀 Ver también
El riesgo mundano: Por qué las mayores amenazas de la seguridad de la IA son aburridas, no dramáticas
Un ensayo argumenta que los fallos mundanos de la IA ya están causando daños a gran escala, los enfoques actuales de alineación dependen demasiado de entornos controlados, y la convergencia de capacidades hace que la exposición accidental al mundo abierto sea cada vez más plausible.

Claude Code v2.1.116: Mejoras de rendimiento, correcciones de terminal y actualizaciones de seguridad
Claude Code v2.1.116 ofrece mejoras significativas de rendimiento que incluyen hasta un 67% más rápido en /resume para sesiones de 40MB+, desplazamiento más suave en terminal y arranque más rápido de MCP. La versión también corrige problemas de renderizado en terminal, añade protecciones de seguridad para operaciones de rutas peligrosas y resuelve múltiples errores que afectan a comandos de barra y gestión de complementos.

Puertas de Atención: El Desafío del Olvido Selectivo en los Sistemas de Memoria de IA
Un desarrollador que construye un sistema de memoria de cinco capas para un bot OpenClaw identifica una limitación clave: los enfoques actuales se centran en la recuperación, pero carecen de mecanismos para suprimir información irrelevante durante tareas enfocadas, similar al filtro atencional humano.

Liberación de Claude-Code v2.1.25: Corrección de Error de Validación
Claude-Code v2.1.25 aborda un problema de validación de encabezados beta que afecta a los usuarios de gateway en Bedrock y Vertex, con una solución alternativa a través de una variable de entorno específica.