Medición del gasto de tokens fuera de tarea en Claude Code: La métrica de 'intención no declarada'

Un desarrollador que construye hooks personalizados para Claude Code creó una métrica llamada gasto de intención no declarada para medir el uso de tokens fuera del objetivo declarado.
Hallazgos clave
- En una sesión, el cómputo total fue de 5,137 tokens, con 1,173 (22.8%) clasificados como no declarados y 3,964 (77.2%) como declarados.
- El gasto no declarado captura el costo de reintentos, bucles, desviación de razonamiento y ejecución fuera de tarea, no solo violaciones de gobernanza.
- La métrica trata el costo como una señal de comportamiento, no solo telemetría de facturación.
Desafío de implementación
La superficie del hook no siempre expone suficiente contexto para distinguir la desviación real de la intención indeterminable. El autor señala dos modos de falla distintos: desviación genuina (se metió en archivos/sistemas no relacionados) vs. indeterminable desde los datos del hook. Se necesitan respuestas diferentes según el modo.
Formato de salida de ejemplo:
Total compute 5,137 tokens
Undeclared 1,173 tokens (22.8%)
Declared 3,964 tokens (77.2%)
No se comparte ninguna herramienta o biblioteca en la fuente; la publicación es un tema de discusión. El autor está interesado en si otros están midiendo el cómputo fuera de tarea o si aún tratan el gasto de tokens como mera facturación/optimización.
📖 Leer la fuente completa: r/ClaudeAI
👀 Ver también

Pila de modelos de IA de código abierto para un reemplazo rentable de Claude
Un usuario de Reddit comparte una pila de modelos de IA funcional que utiliza modelos de código abierto como Llama 3.3 70b y DeepSeek R1 32b para ejecución local, reduciendo los costos mensuales de IA de más de £60 a menos de £3 al enrutar el 90% de las tareas a modelos gratuitos.

RelayPlane Proxy de Código Abierto Muestra una Reducción del 73% en Costos con Enrutamiento del Modelo Claude
RelayPlane, un proxy nativo de npm de código abierto para la API de Anthropic, demostró un ahorro de costos del 73,4% en pruebas comparativas al enrutar solicitudes a los modelos Claude apropiados según la complejidad. La herramienta redujo el costo por 10 solicitudes de $0,0323 a $0,0086 mientras mejoraba la latencia p50 de 1,55s a 0,78s.

LLMSpend: Rastreador de costos de código abierto para los SDKs de Anthropic y OpenAI
LLMSpend es una biblioteca de Python que añade seguimiento de costos a las llamadas SDK de Anthropic y OpenAI con solo dos líneas de código. Proporciona almacenamiento local SQLite, informes CLI y un panel web sin enviar datos externamente.

Tripsy lanza el servidor MCP para Claude: gestiona viajes mediante API estructurada
El servidor MCP oficial de Tripsy permite a Claude leer, crear y actualizar viajes, actividades, estancias, transportes y gastos. La configuración toma ~1 minuto mediante el conector personalizado de Claude.