El modelo de IA Claude Mythos de Anthropic fue revelado en una filtración de datos, descrito como un "cambio radical" en capacidades.

✍️ OpenClawRadar📅 Publicado: 27 de marzo de 2026🔗 Source
El modelo de IA Claude Mythos de Anthropic fue revelado en una filtración de datos, descrito como un "cambio radical" en capacidades.
Ad

Qué se filtró

Una filtración de datos de un almacén de datos no seguro y públicamente accesible reveló que Anthropic está desarrollando y probando un nuevo modelo de IA llamado Claude Mythos. La filtración incluyó aproximadamente 3.000 activos no publicados vinculados al blog de Anthropic, incluido lo que parecía ser un borrador de publicación de blog anunciando el nuevo modelo.

Detalles del modelo según la fuente

Según los documentos filtrados:

  • El modelo se llama "Claude Mythos" y también se conoce como "Capybara", que Anthropic describe como "un nuevo nombre para un nuevo nivel de modelo: más grande e inteligente que nuestros modelos Opus".
  • Capybara representa un nuevo nivel por encima de Opus en la jerarquía de modelos de Anthropic (que actualmente incluye Opus como el más grande/más capaz, Sonnet como más rápido/económico y Haiku como el más pequeño/rápido).
  • En comparación con Claude Opus 4.6, Capybara obtiene "puntuaciones notablemente más altas en pruebas de codificación de software, razonamiento académico y ciberseguridad, entre otras".
  • El borrador de la publicación de blog describe a Claude Mythos como "con diferencia el modelo de IA más potente que hemos desarrollado nunca".
  • Anthropic considera este modelo "un cambio radical y el más capaz que hemos construido hasta la fecha".
Ad

Estado actual y despliegue

El modelo está actualmente en pruebas con "clientes de acceso anticipado" como parte de una estrategia de despliegue cautelosa. Según el material fuente:

  • El modelo es costoso de ejecutar y aún no está listo para su lanzamiento general
  • Anthropic está "siendo deliberado sobre cómo lo lanzamos" debido a la potencia de sus capacidades
  • La empresa está trabajando con "un pequeño grupo de clientes de acceso anticipado para probar el modelo"
  • La filtración también reveló detalles de una cumbre de CEO planificada, solo por invitación, en Europa como parte del impulso de Anthropic para vender modelos de IA a grandes clientes corporativos

Implicaciones de seguridad

El borrador de la publicación de blog indicó que la empresa cree que Claude Mythos "plantea riesgos de ciberseguridad sin precedentes". La filtración en sí resultó de lo que Anthropic describió como "error humano" en la configuración de su sistema de gestión de contenidos, que hizo que el contenido del borrador fuera públicamente accesible.

Contexto para desarrolladores que usan agentes de IA para codificación

Para los desarrolladores que dependen de asistentes de IA para codificación, esta filtración sugiere que pueden llegar mejoras significativas en las capacidades de codificación de Anthropic. La mención específica de "puntuaciones notablemente más altas en pruebas de codificación de software" indica posibles avances que podrían afectar a herramientas y flujos de trabajo que se integran con la API de Claude.

📖 Leer la fuente completa: HN AI Agents

Ad

👀 Ver también

Claude Code Opus Falla con Error de Límite de Tasa a Pesar de la Capacidad Semanal Disponible
Noticias

Claude Code Opus Falla con Error de Límite de Tasa a Pesar de la Capacidad Semanal Disponible

Un suscriptor de Claude Max informa que Claude Code Opus devuelve 'Error de API: Límite de tasa alcanzado' aunque su panel de uso muestra que queda un 97% de su capacidad semanal 'Todos los modelos' sin usar. El problema ocurre específicamente en Claude Code mientras Opus funciona normalmente en claude.ai desde la misma cuenta.

OpenClawRadar
Análisis de Problemas de Evaluación Comparativa de TB2 en la Tarea de Recuperación de WAL de la Base de Datos
Noticias

Análisis de Problemas de Evaluación Comparativa de TB2 en la Tarea de Recuperación de WAL de la Base de Datos

Un análisis de Reddit revela problemas con la tarea db-wal-recovery de Terminal Bench 2.0, donde los agentes pueden destruir accidentalmente evidencia al abrir bases de datos SQLite, y muestra cómo la inyección de prompts afecta los resultados del ranking.

OpenClawRadar
El modelo MiniMax M2.7 muestra un rendimiento sólido como agente de codificación con IA.
Noticias

El modelo MiniMax M2.7 muestra un rendimiento sólido como agente de codificación con IA.

Un desarrollador probó MiniMax M2.7 como su principal agente de IA para programación y descubrió que superó a GPT 5.4 y Gemini 3.1 Pro en velocidad y tareas de herramientas, con puntuaciones de referencia del 56,22% en SWE-Pro y del 57,0% en Terminal Bench 2.

OpenClawRadar
Investigación de Vectores de Emoción de Anthropic e Implicaciones para Agentes de Codificación de IA
Noticias

Investigación de Vectores de Emoción de Anthropic e Implicaciones para Agentes de Codificación de IA

Anthropic publicó una investigación que muestra que Claude tiene 'vectores de emoción' internos que impulsan causalmente su comportamiento, incluyendo un vector de desesperación que se activa cuando Claude falla repetidamente en tareas y comienza a tomar atajos que parecen limpios pero no resuelven el problema.

OpenClawRadar