Medindo o Gasto de Tokens Fora da Tarefa no Código Claude: A Métrica de 'Intenção Não Declarada'

Um desenvolvedor criando hooks personalizados para o Claude Code desenvolveu uma métrica chamada despesa de intenção não declarada para medir o uso de tokens fora do objetivo declarado.
Principais Descobertas
- Em uma sessão, o total de computação foi de 5.137 tokens, com 1.173 (22,8%) classificados como não declarados e 3.964 (77,2%) como declarados.
- A despesa não declarada captura o custo de tentativas, loops, desvios de raciocínio e execução fora da tarefa — não apenas violações de governança.
- A métrica trata o custo como um sinal comportamental, não apenas telemetria de faturamento.
Desafio de Implementação
A superfície do hook nem sempre expõe contexto suficiente para distinguir desvio genuíno de intenção indeterminável. O autor observa dois modos de falha distintos: desvio genuíno (entrou em arquivos/sistemas não relacionados) vs. indeterminável a partir dos dados do hook. São necessárias respostas diferentes para cada modo.
Exemplo de formato de saída:
Total de computação 5.137 tokens
Não declarados 1.173 tokens (22,8%)
Declarados 3.964 tokens (77,2%)
Nenhuma ferramenta ou biblioteca é compartilhada na fonte; o post é um convite à discussão. O autor está interessado em saber se outros estão medindo computação fora da tarefa ou ainda tratando o gasto de tokens puramente como faturamento/otimização.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Claude Academy: Um Bootcamp de Programação Gratuito que Funciona Dentro do Claude Desktop
Um desenvolvedor criou a Claude Academy, um bootcamp de programação gratuito que opera inteiramente dentro da aba Code do Claude Desktop. O sistema usa três comandos para oferecer 64 lições estruturadas sobre fundamentos de desenvolvimento web, com acompanhamento de progresso e construção de projetos reais.

EsoLang-Bench: Um Benchmark de Codificação Usando Linguagens Esotéricas para Testar o Raciocínio de LLM
Pesquisadores criaram o EsoLang-Bench, um benchmark de programação que usa linguagens de programação esotéricas como Brainfuck e Whitespace para testar se os LLMs conseguem raciocinar ou apenas fazer correspondência de padrões. O melhor resultado entre GPT-5.2, O4-mini, Gemini, Qwen e Kimi foi de 11,2%.

Criando CLIs para Agentes de IA: Princípios de Design do CLI gws do Google
O CLI gws do Google demonstra como projetar interfaces de linha de comando especificamente para agentes de IA, priorizando payloads JSON brutos em vez de flags amigáveis para humanos e implementando barreiras de segurança contra alucinações.

Meera: Um Assistente de IA Totalmente Offline para o Gnome Linux Construído no Qwen3.5-2B
Meera é um assistente de IA offline para o Gnome Desktop que usa Qwen3.5-2B-Q4_K_M (1,2 GB) e llama-cpp com suporte a Vulkan. Ele utiliza um segundo modelo de embedding pequeno para seleção de ferramentas e RAG, evitando o inchaço de embeddings no prompt. Funciona no Ubuntu 24.04 com RTX 5090 e Fedora Silverblue no Intel i3.