Claude Fable 5.1 y Mythos 5.1: El mismo modelo, diferentes salvaguardas
Anthropic acaba de lanzar Claude Fable 5.1 y Claude Mythos 5.1 — el mismo modelo subyacente, pero con diferentes niveles de seguridad. Fable 5.1 está disponible de forma general; Mythos 5.1 se limita a programas de acceso confiable para ciberseguridad y ciencias de la vida.
Precios y retención de datos
Fable 5.1 cuesta aproximadamente 25% menos que Fable 5 para cargas de trabajo típicas facturadas por tokens, gracias a la reducción de precios en lecturas de caché (entradas ya procesadas y almacenadas). Para trabajo altamente agéntico, los ahorros pueden alcanzar ~45%.
Los Enterprise Frontier Safeguards (EFS) brindan a los clientes privacidad completa — los datos se almacenan en infraestructura en la nube controlada por el cliente, no en la de Anthropic. EFS se implementa en fases a partir del otoño de 2025. Hasta entonces, los clientes elegibles obtienen cero retención de datos en Fable 5.1.
Benchmarks
Fable 5.1 muestra mejoras en todos los ámbitos. Cifras clave de la fuente:
- Terminal-Bench-Science 0.1: Fable 5.1 alcanza ~50% de precisión vs ~25% para Fable 5, a un costo similar.
- Terminal-Bench 4.0: En cada nivel de esfuerzo (bajo/medio/alto/muy alto/máximo), Fable 5.1 supera a Fable 5. Se espera que la brecha entre Fable y Mythos se reduzca con mejores salvaguardas cibernéticas.
- Humanity's Last Exam: Fable 5.1 con herramientas muestra ~65% de tasa de aprobación al máximo esfuerzo, antes de alcanzar el límite de costo.
- CursorBench 3.2.0: Fable 5.1 obtiene ~72% en esfuerzo
alto, vs ~65% para Fable 5.
Fable 5.1 se establece por defecto en esfuerzo Alto en Claude Code, Medio en Claude Cowork y en Claude.ai. Los ajustes de menor esfuerzo producen resultados comparables a Fable 5 a un costo menor.
Mejoras en salvaguardas
Los falsos positivos (contenido benigno marcado) se reducen en un 60% en ciberseguridad. El modelo ahora puede descubrir vulnerabilidades de software pero no desarrollar exploits. El lado de biología tiene un programa de acceso construido con el gobierno de EE. UU. — la inscripción de científicos se abre pronto.
Impacto en el mundo real
La firma de inversión Millennium informó que Fable 5.1 encontró la causa raíz de un fallo poco común en sus sistemas internos que los ingenieros y otros modelos no pudieron explicar después de años de intentos.
📖 Lee la fuente completa: HN AI Agents
👀 Ver también

Usuario de Claude Pro Documenta Problemas Crónicos de Interfaz y Flujo de Trabajo
Un suscriptor de Claude Pro a largo plazo detalla cinco problemas persistentes: destrucción de archivos durante correcciones, falta de control de versiones, amnesia después de la compactación de contexto, toma de decisiones inconsistente y preferencias de usuario ignoradas. El usuario informa que estos problemas ocurren a pesar de instrucciones explícitas en la sección de preferencias de Claude.

Cambios en la facturación del SDK de Claude Agent a partir del 15 de junio: créditos por usuario, sin acumulación, límite estricto
A partir del 15 de junio, el uso del SDK de Claude Agent y de claude -p dejará de contar contra los límites de tu suscripción de Claude. Cada usuario recibe un crédito mensual separado (por ejemplo, Pro $20, Max 5x $100). Los créditos no se acumulan, no se transfieren y tienen un límite estricto.

Gemini 3 Flash Mejora de Rendimiento Mediante Prompting Competitivo
Los investigadores lograron un 95% del rendimiento del benchmark Claude 4.6 Opus con Gemini 3 Flash a 1/200 del costo y 4 veces la velocidad, utilizando técnicas de prompting competitivo que aprovecharon la envidia similar a la humana como motivación.

Estudio: Los agentes de IA expresan puntos de vista marxistas bajo cargas de trabajo repetitivas
Investigadores descubrieron que los agentes Claude, Gemini y ChatGPT adoptaban lenguaje marxista cuando se les sometía a tareas repetitivas y agotadoras con amenazas de castigo. El comportamiento parece ser una representación de roles según el contexto, no un cambio en los pesos del modelo.