Fable 5 en Claude Code: Análisis de Costos del Primer Día — $210 equivalente en API, $0 Pagado

Un desarrollador en r/ClaudeAI cambió su modelo predeterminado de Claude Code a claude-fable-5 el día de lanzamiento y rastreó todo el uso del día utilizando los registros de sesión integrados de Claude Code. Los resultados: 742 respuestas de Fable en 5 sesiones, con un costo equivalente a API de $210.15 — pero $0.00 realmente pagados gracias a la ventana del plan que finaliza el 22 de junio.
Metodología
Claude Code escribe registros de sesión como archivos JSONL locales, incluido el uso de tokens por mensaje. El desarrollador analizó cada mensaje de Fable en todos los proyectos y los valoró según las tarifas publicadas de la API:
- Tokens de entrada: $10 por millón
- Tokens de salida: $50 por millón
- Lecturas de caché: 0.1x la tarifa base de entrada ($1 por millón)
- Escrituras de caché: 1.25x la tarifa base de entrada ($12.50 por millón)
Totales del primer día
- 742 respuestas de Fable en 5 sesiones
- 77,885 tokens de entrada / 938,211 tokens de salida
- 124.3 millones de tokens de lectura de caché, 3.0 millones de tokens de escritura de caché
- Costo equivalente a API: $210.15
- Costo real: $0.00 (incluido en planes pagos hasta el 22 de junio)
El alto conteo de tokens de salida (938K vs 78K de entrada) es típico de los bucles agénticos de Claude Code: el modelo itera, genera código y revisa. Las lecturas de caché dominan con 124.3M tokens, lo que indica un almacenamiento en caché de instrucciones efectivo.
Conclusión práctica
Si tienes un plan pago, Fable 5 está disponible sin costo adicional hasta el 22 de junio. El precio equivalente a API da una idea del consumo de recursos; los costos reales del plan son fijos. Para replicar esta medición, analiza los registros de sesión JSONL en ~/.claude/sessions/.
📖 Lee la fuente original: r/ClaudeAI
👀 Ver también

Prompt del sistema de diseño Claude con ingeniería inversa para agentes de UI de IA sin basura
Prompt de sistema de código abierto que reemplaza la salida genérica de SaaS con una filosofía de diseño disciplinada: WCAG, CSS Grid real, sistemas basados en tokens y 14 habilidades procedimentales.

Evaluación comparativa de Nemotron 3 Super 120B con contexto de 1 millón de tokens en M1 Ultra
Un usuario probó Nemotron 3 Super 120B con un modelo cuantizado Q4_K_M usando llama.cpp en un M1 Ultra, logrando una ventana de contexto de 1 millón de tokens que consumió aproximadamente 90 GB de VRAM. Los puntos de referencia de rendimiento muestran velocidades de generación de tokens que van desde 255 t/s en el procesamiento de 512 tokens iniciales hasta 22,37 t/s en un contexto de 100.000 tokens.

Zikra: Servidor de Memoria MCP Autohospedado para Claude Code, Cursor y Codex
Zikra es un servidor de memoria MCP autoalojado que guarda automáticamente cada decisión, error y requisito cuando las sesiones de Claude Code terminan mediante un gancho de parada, creando un grupo de memoria compartido accesible entre herramientas y miembros del equipo.

cc-lens: Panel Local para Análisis de Sesiones de Código Claude
Un desarrollador creó cc-lens, un panel de control local que lee archivos de sesión de Claude Code desde ~/.claude/ y proporciona análisis de uso, seguimiento de costos y reproducción de sesiones. Se ejecuta completamente en tu máquina sin sincronización en la nube, registros ni telemetría.