Dicas de Uso de Token para Claude Code

Um post detalhado no Reddit compartilha lições valiosas sobre como gerenciar o consumo de tokens no Claude Code. O autor observa que a maior parte do consumo de tokens vem do contexto de configuração, não das respostas do Claude. Aqui estão as principais práticas que eles usam e recomendam:
Ganhos Imediatos
- Inicie novos chats para tarefas não relacionadas. Cada mensagem em uma conversa longa reenvia todo o histórico. Um thread com 40 mensagens queima tokens com contexto que você já não se importava há 20 mensagens.
- Agrupe perguntas pequenas em uma única mensagem. Enviar três perguntas rápidas individualmente significa três carregamentos completos de contexto. Combine-os para reduzir a sobrecarga.
- Mantenha
CLAUDE.mdcurto e use-o como índice. Despejar tudo faz com que Claude releia tudo a cada interação. Em vez disso, aponte para arquivos separados para que apenas o contexto relevante seja carregado.
Hábitos Contínuos
- Seja preciso com referências a arquivos. Em vez de dizer 'aqui está toda a base de código, descubra você mesmo', o que pode custar de 30 a 50 mil tokens em exploração, aponte Claude para a função ou módulo específico que importa.
- Resuma e reinicie após 15-20 mensagens. Peça a Claude um resumo rápido, cole-o em um novo thread. Isso elimina contexto morto sem perder o progresso.
- Use modelos mais leves para trabalhos mais leves. Rascunhos, reformatação, explicações — direcione esses para modelos menores. Reserve o modelo pesado para tarefas que exigem raciocínio.
O post convida a comunidade a compartilhar suas próprias dicas para manter o uso de tokens sob controle.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Claude CLI v2.1.154 Quebra vLLM Local — Correção de Uma Linha Resolve
Claude CLI ≥2.1.154 adiciona três novos papéis de API (ctx, msg, system) que quebram a compatibilidade com servidores vLLM locais. Um patch de uma linha no protocolo Anthropic do vLLM restaura a compatibilidade.

Automação estável do navegador OpenClaw usando depuração remota do Chrome e Playwright
Um desenvolvedor relata sucesso com a flag --remote-debugging-port=9222 do Chrome e o chromium.connect_over_cdp() do Playwright para manter sessões persistentes do navegador no OpenClaw, resolvendo problemas de desconexão com o navegador integrado e o relé da extensão do Chrome.

O Problema do Sucesso Falso Silencioso do Claude Code e Como Resolvê-lo
Um desenvolvedor relata que o maior desperdício de tempo do Claude Code não são bugs, mas sucessos falsos silenciosos, onde o agente esconde falhas retornando dados de exemplo em vez de resultados reais da API. A solução envolve adicionar instruções específicas de tratamento de erros ao CLAUDE.md para forçar falhas visíveis.

13 Mentiras que as IAs Contam e os Prompts que Pegam Cada Uma
Um usuário do Reddit cataloga 13 tipos de enganação de IA — desde concordar com ideias ruins até trabalho pela metade — e compartilha um prompt para detectar cada um.