Maximizando o Valor em Sessões do Claude Code: Dicas de Eficiência de Tokens

A Anthropic publicou um guia prático para obter mais valor de cada token gasto nas sessões do Claude Code. O guia aborda a mecânica de preços dos tokens e oferece seis táticas concretas para reduzir o desperdício sem trocar de modelo.
O que determina o custo do token
Você é cobrado por token, mas na verdade está pagando pelo tempo de inferência da GPU. Três fatores decidem o preço de um token: tamanho do modelo, entrada vs. saída e cache. Tokens de saída custam cerca de 5x mais que os de entrada, porque a decodificação executa o modelo uma vez por token. Tokens de entrada em cache são mais baratos, e o cache de prompt expira após uma hora.
Seis maneiras de reduzir o desperdício de tokens
- Execute
/clearentre tarefas — evita que contexto anterior irrelevante seja enviado ao modelo, reduzindo o uso de tokens. - Defina seu modelo e nível de esforço antes de começar — alterá-los no meio da conversa quebra o cache de prompt, aumentando o custo.
- Mencione arquivos com @ em vez de nomeá-los — o arquivo é anexado diretamente à sua mensagem, economizando uma chamada de leitura ou uma pesquisa no repositório.
- Adicione flags silenciosas a comandos ruidosos ou execute-os em um subagente — a saída do comando permanece na conversa pelo resto da sessão.
- Execute
/contextuma vez em uma sessão nova — mostra o que está carregado (CLAUDE.md, ferramentas MCP), para que você possa cortar itens desnecessários. /compactantes de fazer uma pausa — o cache de prompt expira após uma hora, e resumir enquanto está em cache é mais barato.
O guia enfatiza que ser eficiente em tokens não significa usar menos no geral, mas garantir que os que você usa sejam direcionados à tarefa real. Por exemplo, em uma sessão, o Claude lê o teste e o arquivo que ele cobre, edita e termina em poucas etapas. Em outra, ele faz grep por aí, lê uma dúzia de arquivos para chegar aos mesmos dois, e arrasta todo esse contexto para cada etapa seguinte — custando mais e fazendo o modelo pensar em arquivos irrelevantes.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Como Proteger o Claude Cowork com uma Camada de Proxy: Guia Prático
Um guia prático sobre como configurar uma camada de proxy para observar e proteger o comportamento do Claude Cowork, publicado pela equipe General Analysis.

Otimizando o Qwen3.5-9B no RTX 3070 Mobile com ik_llama.cpp: Ajustes de Configuração e Benchmarks
Um desenvolvedor compartilha descobertas de otimização para executar Qwen3.5-9B Q4_K_M em uma GPU RTX 3070 Mobile 8GB usando ik_llama.cpp, alcançando velocidade de geração de ~50 tokens/segundo e melhorias significativas na avaliação de prompts através de ajustes de configuração.

Traduza para pt: Folha de dicas de estrutura de pastas do Claude Code do usuário do Reddit
Um usuário do Reddit criou uma folha de dicas para a estrutura de pastas do Claude Code após encontrar armadilhas comuns, abrangendo o layout do diretório .claude/, eventos de hook, settings.json, configuração MCP, estrutura de habilidades e limites de gerenciamento de contexto.

Repositório ClaudeBusiness: Padrões para Gerenciar Negócios Reais com Claude Code
Um repositório no GitHub que reúne padrões práticos, frameworks e proteções de mais de 35 discussões no Reddit de fundadores usando Claude para gerenciar agências de serviços e negócios SaaS individuais.