Analizando el Consumo de Tokens en la Ventana de Contexto de 1 Millón de Claude: Los Datos Muestran Crecimiento Ilimitado y Acumulación de Fallos de Caché

✍️ OpenClawRadar📅 Publicado: 13 de abril de 2026🔗 Source
Analizando el Consumo de Tokens en la Ventana de Contexto de 1 Millón de Claude: Los Datos Muestran Crecimiento Ilimitado y Acumulación de Fallos de Caché
Ad

Análisis del Consumo de Tokens a partir de Datos de Uso Real

Un análisis detallado de la implementación de la ventana de contexto de 1 millón de tokens de Claude revela factores técnicos específicos que causan un consumo rápido de tokens. El autor analizó archivos de sesión JSONL a través de múltiples conversaciones para identificar patrones.

Hallazgos Clave a partir de los Datos

Crecimiento Ilimitado del Contexto: Antes de la ventana de contexto de 1 millón de tokens, la compactación automática se activaba aproximadamente a los 160K tokens. Después de la implementación de 1 millón, este límite desaparece, permitiendo que las sesiones alcancen regularmente 500K+ tokens. Cada solicitud reenvía todo el contexto, lo que significa que a 500K tokens, incluso una simple confirmación cuesta 500K tokens. Si Claude realiza 3 llamadas a herramientas para responder a una solicitud, eso son 1.5 millones de tokens para una sola interacción.

Compounding de Fallas de Caché: Anthropic almacena en caché el contexto en el servidor durante aproximadamente 5 minutos. Después de esta ventana, la siguiente solicitud reprocesa el contexto completo a aproximadamente 10 veces el precio en caché. Aunque la tasa de fallas de caché no ha cambiado (permaneciendo en aproximadamente el 2.5% de los turnos), una falla de caché en un contexto de 500K es significativamente más costosa que una en un contexto de 150K.

Ad

Herramienta de Análisis

El autor creó un script de Python que analiza los recuentos de tokens de los archivos de sesión JSONL de Claude sin acceder al contenido de la conversación. El script detecta automáticamente tu directorio de datos de Claude y requiere matplotlib y numpy. El script está disponible en: https://github.com/RyanSeanPhillips/cldctrl/blob/master/docs/context_analysis.py

El autor también menciona CLD CTRL (https://github.com/RyanSeanPhillips/cldctrl), un panel de control de terminal para lanzar y monitorear sesiones de Claude Code, uso de tokens y actividad del proyecto.

📖 Read the full source: r/ClaudeAI

Ad

👀 Ver también

Bonsai 27B: Primer modelo de clase 27B funciona en un teléfono — Puntuaciones de referencia y especificaciones
Noticias

Bonsai 27B: Primer modelo de clase 27B funciona en un teléfono — Puntuaciones de referencia y especificaciones

PrismML lanza Bonsai 27B, un modelo ternario/binario de 27B parámetros que ocupa 3.9-5.9 GB y funciona en teléfonos y laptops. Retiene el 90-95% del rendimiento de la línea base de precisión completa.

OpenClawRadar
NHS Inglaterra retrocede del código abierto: carta abierta insta a revertir la política SDLC-8
Noticias

NHS Inglaterra retrocede del código abierto: carta abierta insta a revertir la política SDLC-8

Una carta abierta con 74 firmas pide a NHS England que retire SDLC-8, una política que oculta todo el código fuente del NHS, y que reafirme el Principio 12 del Estándar de Servicio del NHS: 'Hacer que el nuevo código fuente sea abierto'.

OpenClawRadar
Informe del Índice de IA 2026 de Stanford: Tendencias Clave sobre Inversión, Modelos y Percepción Pública
Noticias

Informe del Índice de IA 2026 de Stanford: Tendencias Clave sobre Inversión, Modelos y Percepción Pública

El informe Índice de IA 2026 de Stanford muestra que la inversión en IA se está disparando, mientras que el impacto en los empleos y la percepción pública sigue siendo mixto. Las empresas estadounidenses lanzaron 50 modelos de IA notables en 2025, con China reduciendo la brecha.

OpenClawRadar
Claude Code v2.1.98 agrega el asistente de Vertex AI, correcciones de seguridad y aislamiento de subprocesos.
Noticias

Claude Code v2.1.98 agrega el asistente de Vertex AI, correcciones de seguridad y aislamiento de subprocesos.

Claude Code v2.1.98 presenta un asistente interactivo de configuración de Google Vertex AI, añade aislamiento de subprocesos con espacio de nombres PID en Linux, y corrige múltiples vulnerabilidades de seguridad incluyendo omisiones de permisos Bash y riesgos de ejecución de código arbitrario.

OpenClawRadar