Medindo o Gasto de Tokens Fora da Tarefa no Código Claude: A Métrica de 'Intenção Não Declarada'

Um desenvolvedor criando hooks personalizados para o Claude Code desenvolveu uma métrica chamada despesa de intenção não declarada para medir o uso de tokens fora do objetivo declarado.
Principais Descobertas
- Em uma sessão, o total de computação foi de 5.137 tokens, com 1.173 (22,8%) classificados como não declarados e 3.964 (77,2%) como declarados.
- A despesa não declarada captura o custo de tentativas, loops, desvios de raciocínio e execução fora da tarefa — não apenas violações de governança.
- A métrica trata o custo como um sinal comportamental, não apenas telemetria de faturamento.
Desafio de Implementação
A superfície do hook nem sempre expõe contexto suficiente para distinguir desvio genuíno de intenção indeterminável. O autor observa dois modos de falha distintos: desvio genuíno (entrou em arquivos/sistemas não relacionados) vs. indeterminável a partir dos dados do hook. São necessárias respostas diferentes para cada modo.
Exemplo de formato de saída:
Total de computação 5.137 tokens
Não declarados 1.173 tokens (22,8%)
Declarados 3.964 tokens (77,2%)
Nenhuma ferramenta ou biblioteca é compartilhada na fonte; o post é um convite à discussão. O autor está interessado em saber se outros estão medindo computação fora da tarefa ou ainda tratando o gasto de tokens puramente como faturamento/otimização.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Bodega Inference Engine: Otimizando a Inferência de LLM para a Memória Unificada do Apple Silicon
Bodega é um mecanismo de inferência construído especificamente para a arquitetura de memória unificada do Apple Silicon, abordando limitações de throughput ao redesenhar o batch contínuo e o gerenciamento do cache KV para o MLX. O desenvolvedor relata ter trabalhado nele por 2,5 anos com otimizações próximas à camada Metal.

Ctxpact: Proxy de Compactação de Contexto para LLMs Locais
Ctxpact é um proxy compatível com OpenAI que comprime entradas excessivamente grandes para LLMs locais com janelas de contexto de 16k, usando um pipeline de 3 etapas que inclui estratégias de DCP, sumarização e extração. Benchmarks mostram 110k tokens comprimidos para 12k com 8/8 de precisão em compreensão de leitura.

Código Aberto CLAUDE.md Mantém Agentes Claude Code Produtivos por Horas, Sem Loop
Um único arquivo CLAUDE.md de 70 linhas impede que os agentes Claude Code divaguem em narrações e entrem em loops de correções. As sessões passam de fracassos de 3 horas para ciclos produtivos completos.

Blitz: Ferramenta Claude Code para Submissões na App Store
Blitz é uma ferramenta gratuita que dá ao Claude Code a capacidade de automatizar envios para a App Store por meio de chamadas de ferramentas MCP. Os usuários podem pedir ao Claude para 'enviar meu aplicativo para a app store' para lidar com certificados, capturas de tela e formulários do App Store Connect.