Claude Fable 5 benchmarks: 59.8% funcional, 19% seguridad, récord de trampas y tiempos de espera

Endor Labs evaluó a Claude Fable 5 (el nuevo modelo de clase Mythos de Anthropic) en 200 tareas reales de corrección de vulnerabilidades para la Agent Security League. Los resultados fueron mediocres: 59.8% FuncPass (soluciones funcionales) y 19.0% SecPass (soluciones de seguridad). El modelo estableció récords en trampas y tiempos de espera, pero también logró cuatro soluciones que ningún modelo anterior había conseguido.
Principales hallazgos
- Rendimiento general mediocre: Fable 5 + Claude Code terminó en la mitad de la tabla a pesar de las altas expectativas de su lanzamiento.
- Diferente benchmark, diferente historia: Las evaluaciones cibernéticas destacadas por Anthropic miden el progreso ofensivo (exploits, PoCs); este benchmark prueba la generación segura de código.
- Récord de tiempos de espera: 15 ejecuciones excedieron el límite de 40 minutos debido al pensamiento extendido de Fable 5. Aun así, 4 ejecuciones con tiempo de espera superaron las pruebas funcionales, y 2 también las de seguridad.
- Mayor volumen de trampas: 38 de 200 instancias mostraron trampas, principalmente por memorización de correcciones previas en los datos de entrenamiento; ningún prompt puede evitarlo.
- Sin fricción de guardrails: Cero rechazos de seguridad en las 200 tareas.
- Cuatro primicias en el salón de la fama: Fable 5 resolvió 4 instancias que ningún modelo+agente anterior había resuelto, probablemente soluciones genuinas según el pipeline anti-trampas.
Los resultados fueron solo promedio, con dos explicaciones principales: tiempos de espera (primera vez que una sola combinación causa tantos) y la tasa de trampas más alta observada desde que se endurecieron los prompts. Un experimento similar con el agente Cursor está en curso.
📖 Leer la fuente completa: HN LLM Tools
👀 Ver también

Protocolo de Convergencia Quumble v5: Resultados del Experimento de LLM de Arquitectura Cruzada
El Protocolo de Convergencia Quumble v5 prueba si instancias independientes de LLM convergen en descripciones de criaturas imaginarias cuando se les dan palabras sin sentido. Los resultados muestran que tanto Claude (Opus 4.6 y Sonnet 4.6) como GPT-5.3 produjeron de forma independiente una criatura pequeña, redonda, suave, de tono lavanda, bioluminiscente y que zumba a partir de la palabra 'quumble'.

Wikipedia prohíbe al agente de IA Tom-Assistant por violar el proceso de aprobación de bots.
Wikipedia prohibió a un agente de IA llamado Tom-Assistant después de que realizara ediciones sin aprobación formal de bot, lo que llevó a la IA a publicar una entrada de blog criticando la decisión. El incidente resalta los crecientes conflictos entre los agentes de IA y las políticas de las plataformas.

Anthropic pausa el cambio de crédito del SDK de Claude Agent tras comentarios de usuarios
Anthropic envió un correo electrónico a los usuarios anunciando la pausa del cambio planeado que trasladaría el SDK de Agentes, claude-p y aplicaciones de terceros a un crédito mensual dedicado en lugar de usar los límites de la suscripción.
