Maximizando o Valor em Sessões do Claude Code: Dicas de Eficiência de Tokens

A Anthropic publicou um guia prático para obter mais valor de cada token gasto nas sessões do Claude Code. O guia aborda a mecânica de preços dos tokens e oferece seis táticas concretas para reduzir o desperdício sem trocar de modelo.
O que determina o custo do token
Você é cobrado por token, mas na verdade está pagando pelo tempo de inferência da GPU. Três fatores decidem o preço de um token: tamanho do modelo, entrada vs. saída e cache. Tokens de saída custam cerca de 5x mais que os de entrada, porque a decodificação executa o modelo uma vez por token. Tokens de entrada em cache são mais baratos, e o cache de prompt expira após uma hora.
Seis maneiras de reduzir o desperdício de tokens
- Execute
/clearentre tarefas — evita que contexto anterior irrelevante seja enviado ao modelo, reduzindo o uso de tokens. - Defina seu modelo e nível de esforço antes de começar — alterá-los no meio da conversa quebra o cache de prompt, aumentando o custo.
- Mencione arquivos com @ em vez de nomeá-los — o arquivo é anexado diretamente à sua mensagem, economizando uma chamada de leitura ou uma pesquisa no repositório.
- Adicione flags silenciosas a comandos ruidosos ou execute-os em um subagente — a saída do comando permanece na conversa pelo resto da sessão.
- Execute
/contextuma vez em uma sessão nova — mostra o que está carregado (CLAUDE.md, ferramentas MCP), para que você possa cortar itens desnecessários. /compactantes de fazer uma pausa — o cache de prompt expira após uma hora, e resumir enquanto está em cache é mais barato.
O guia enfatiza que ser eficiente em tokens não significa usar menos no geral, mas garantir que os que você usa sejam direcionados à tarefa real. Por exemplo, em uma sessão, o Claude lê o teste e o arquivo que ele cobre, edita e termina em poucas etapas. Em outra, ele faz grep por aí, lê uma dúzia de arquivos para chegar aos mesmos dois, e arrasta todo esse contexto para cada etapa seguinte — custando mais e fazendo o modelo pensar em arquivos irrelevantes.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

OpenClaw 102: Dicas Atualizadas de Configuração para Segurança e Eficiência
Um usuário do Reddit compartilha conselhos atualizados sobre configuração do OpenClaw, incluindo criptografia de chaves API com scripts do Windows PowerShell, defesas contra injeção de prompt em AGENTS.md, uso do Tailscale para acesso remoto e regras anti-loop para evitar falhas repetitivas.

Otimização de Custos do OpenClaw: Cinco Configurações para Uso Contínuo do Agente
Um desenvolvedor executando o OpenClaw continuamente em um Raspberry Pi identificou cinco configurações que reduziram significativamente os custos do agente, otimizando para economia em vez da capacidade padrão.

Recomendações de Configuração de LLM Local para OpenClaw
Um usuário compartilha sua configuração para executar um LLM local com o OpenClaw, usando um GB10 para processamento de IA e um Mac mini para a instalação do OpenClaw, com detalhes específicos do modelo e do servidor.

Conectando o CludeCode a Aplicativos Web para Interação Automatizada
Explore como o CludeCode pode ser usado para interagir automaticamente com aplicações web aproveitando ferramentas de IA como navegadores e utilitários de scraping.