Claude Code v2.1.51 cambió la facturación del contexto de 1M sin notificación.

Qué cambió en Claude Code v2.1.51
Anthropic lanzó Claude Code v2.1.51 con un cambio significativo en la facturación que no fue anunciado en registros de cambios, correos electrónicos o notificaciones dentro de la aplicación. La única indicación visible fue una etiqueta "Facturado como uso extra" añadida a los modelos de contexto de 1M en el selector de modelos.
Cómo cambió la facturación
Antes de v2.1.51, el flujo de facturación funcionaba así:
- Presupuesto de suscripción → (agotado) → El Uso Extra entra en acción
Después de v2.1.51, el flujo de facturación cambió a:
- Cualquier llamada con >200K de contexto → los tokens por encima de 200K van directamente a Uso Extra
- ¿Capacidad de suscripción aún disponible? No importa
Esto significa que usar modelos de contexto de 1M como se pretende—donde el historial de conversación y los resultados de herramientas se acumulan naturalmente—ahora inevitablemente genera cargos de Uso Extra, independientemente de la capacidad de suscripción restante.
Evidencia de la investigación de usuarios
Un suscriptor del plan Max ($100/mes) realizó una investigación detallada de facturación documentada en el issue de GitHub #28927. Analizaron transcripciones de sesiones JSONL con desgloses de tokens por llamada y comparaciones día a día por versión.
Hallazgos clave:
- Antes de la actualización (v2.1.49/50): 2,771 llamadas API, 626 llamadas con más de 200K de contexto, 263M tokens de lectura de caché → $0 de Uso Extra
- Después de la actualización (v2.1.52/53): 794 llamadas API, 209 llamadas con más de 200K de contexto → $48.79 de Uso Extra
La carga de trabajo disminuyó en dos tercios mientras que la factura aumentó sustancialmente.
Implicaciones prácticas
No puedes detectar estos cargos en tiempo real. El medidor de Uso Extra tiene aproximadamente un retraso de 24 horas. Los usuarios que monitorean ambos medidores durante las sesiones no ven cambios hasta que los cargos se materializan a la mañana siguiente.
El plan Max incluye explícitamente modelos de contexto de 1M, pero este cambio de facturación efectivamente convierte el contexto de 1M en un complemento de pago que omite la asignación de suscripción.
📖 Leer la fuente completa: r/ClaudeAI
👀 Ver también

Críticos de arte IA no logran identificar pintura real de Monet, revelando crítica hueca
Un usuario publicó una pintura real de Monet como generada por IA, y los críticos escribieron análisis detallados de sus "defectos", destacando la brecha entre la crítica segura y la comprensión real del arte de IA vs. humano.

Los desarrolladores de Silicon Valley reportan patrones de uso intensivo de Claude AI y tensión en la infraestructura.
Un ingeniero senior de IA en Meta gasta $2K/mes en tokens de Claude Code, ejecuta 2+ agentes simultáneamente y ha creado una extensión de VS Code que genera automáticamente un grafo de conocimiento de Obsidian a partir de conversaciones con Claude. Se informa que la infraestructura está 'completamente destrozada' por implementar código generado por Claude sin revisión.

Uber quema su presupuesto de IA 2026 en 4 meses con Claude Code — $500–$2k por ingeniero al mes
Uber gastó todo su presupuesto de IA de 2026 para abril en Claude Code y Cursor. Los costos mensuales de API alcanzaron entre $500 y $2,000 por ingeniero. El 95% de los ingenieros usan herramientas de IA mensualmente; el 70% del código comprometido es generado por IA.

RTX 4090 vs H100 para el Ajuste Fino de Llama-3-8B: Una Comparación de Costo-Rendimiento
Un desarrollador probó el ajuste fino de Llama-3-8B tanto en una RTX 4090 como en instancias H100 alquiladas. La configuración de la 4090 costó $2,000 por adelantado y tomó 24 horas, mientras que el alquiler de la H100 costó alrededor de $80 y se completó en 4 horas.