Pare de queimar tokens do Claude Code com perguntas de chat

Um desenvolvedor no r/ClaudeAI estava atingindo o limite semanal de US$ 20 do Claude Code toda quinta-feira. Após auditorar os últimos 50 prompts, perceberam que a maioria eram perguntas simples de chat que não precisavam de um agente: "o que esse stack trace está dizendo", "regex para encontrar X", "explique o que esse one-liner bash faz", "converta este curl para httpie" e "qual o jq para extrair o campo Y disso".
Cada um desses prompts no Claude Code pagava o imposto completo de agente — carregamento de contexto, definições de ferramentas, tokens de planejamento — para uma resposta de uma linha. A solução: direcionar todas as perguntas em formato de chat para uma janela de chat comum usando um modelo barato (Haiku ou GPT-mini). Reserve o Claude Code para edições em múltiplos arquivos, refatorações e depuração que realmente precisam de leitura do código-fonte.
Resultados após ~3 semanas
- Passou de atingir o limite semanal na quinta-feira para nunca mais atingi-lo, fazendo a mesma quantidade de trabalho.
- Gasto extra com chamadas de API de modelo barato: aproximadamente US$ 3–4 por semana — insignificante.
- Benefício adicional: as respostas do modelo barato chegam mais rápido do que o Claude Code iniciando seu loop de agente, então perguntas rápidas parecem mais rápidas também.
Nota sobre o fluxo de trabalho
Para evitar alternar entre o terminal (Claude Code) e uma janela de chat, eles agora usam um terminal chamado yaw.sh que coloca um chat multi-provedor no prompt ao lado do Claude Code. Mas qualquer ferramenta de chat em outra janela funciona — a mudança no fluxo de trabalho é o que economiza os tokens.
TL;DR: Se você está atingindo o limite semanal do Claude Code, audite seus últimos 50 prompts. Provavelmente a maioria não precisa de um agente. Remova esses e você provavelmente parará de atingir o limite.
📖 Leia a fonte original: r/ClaudeAI
👀 See Also

Colaborativo vs Diretivo: Prompts de IA Produzem Resultados Diferentes
Uma discussão no Reddit destaca diferenças mensuráveis nos resultados do desenvolvimento assistido por IA entre usuários que colaboram com a IA usando linguagem de 'nós' versus aqueles que dão comandos direcionais de 'faça isso'. A abordagem colaborativa revela becos sem saída e desafia suposições através de contexto compartilhado.

Usuário do Reddit compartilha estrutura de prompt para reduzir desvios na saída de código do Claude em tarefas complexas
Um usuário do Reddit descobriu que usar um layout de prompt estruturado para tarefas mais longas no Claude Code ajuda a evitar a deriva da saída. A abordagem envolve definir elementos específicos como escopo da tarefa, arquivos necessários, critérios de sucesso e parâmetros de evitação antes da execução.

UI Orientado por Anotações: Como Projetar Templates no Figma e Deixar Claude Extrair Coordenadas
Pule a construção de um mecanismo de layout personalizado: crie PNGs planos no Figma, desenhe retângulos coloridos para os slots, alimente ambos ao Claude e obtenha definições de áreas editáveis com alvos de toque. Uma tarde em vez de semanas.

Usando a poesia do ciclo do sono do OpenClaw para rastrear pontos cegos operacionais
Um usuário substitui o prompt do ciclo de sono das 3h do OpenClaw, reaproveitando o diário poético em um banco de dados consultável que rastreia a trajetória da infraestrutura e pontos cegos.