Como um Agente Inativo Queimava 50M Tokens por Dia – e Como Corrigir Isso

Um usuário do OpenClaw no Reddit relatou que o uso da API LLM saltou de 11M para 51M tokens por dia ao longo de seis dias, totalizando 196M tokens — a maior parte desperdiçada por um agente ocioso. A causa: um agente esquecido chamado "main" era acionado pelo heartbeat do OpenClaw a cada 30 minutos, carregando um histórico de sessão de 225k tokens apenas para responder "HEARTBEAT_OK".
O Vazamento: Predominância de cacheRead
Dois números se destacaram na análise do histórico:
- 95% dos tokens eram cacheRead — o modelo relendo o histórico antigo da conversa em vez de fazer trabalho novo.
- 56% de todos os tokens vinham de um único agente chamado "main" que nem estava mais em uso.
O heartbeat rodava 48 vezes ao dia, cada vez carregando uma sessão de meses atrás. Até mesmo um HEARTBEAT.md vazio — destinado a desabilitar o heartbeat — não conseguiu pará-lo naquela versão.
A Solução: Dois Passos
- Limpe a sessão inchada. Apague o arquivo de sessão do agente ocioso. O próximo heartbeat começará do zero. Remova apenas sessões inúteis, mantenha as sessões reais de DM/chat.
- Evite reenchimento. Uma limpeza única não adianta porque o heartbeat continua adicionando à sessão. Use alterações na configuração:
- Defina
heartbeat every: "0m"para desligar completamente o heartbeat se o agente não fizer nada, ou - Defina
isolatedSession: trueelightContext: truepara que cada heartbeat execute em um contexto novo e pequeno (~2-5k tokens) em vez do histórico completo (~100k+).
- Defina
Bônus: outros agentes estavam reutilizando uma única sessão que crescia sem parar porque um ID de sessão não estava realmente começando do zero naquela versão. Reinicie a sessão entre tarefas para manter cada execução limpa.
Lições Aprendidas
- Agentes ociosos não são gratuitos — um heartbeat em uma sessão pesada pode custar mais do que trabalho real.
- Se a maioria dos tokens for
cacheRead, você está pagando para reler o histórico, não por trabalho novo. - Verifique se "desligado" está realmente desligado — o
HEARTBEAT.mdvazio não parou o heartbeat na versão relatada. - Leia os históricos por interação; o uso de tokens é registrado lá por entrada/saída/cacheRead.
O usuário reduziu o uso de tokens em mais da metade com essas alterações de configuração.
📖 Leia a fonte completa: r/openclaw
👀 See Also

5 Principais Capacidades do OpenClaw Disponíveis Sem Instalar Habilidades
A instalação básica do OpenClaw pode lidar com operações de arquivos, comandos de shell, busca na web, tarefas agendadas e fluxos de trabalho de múltiplas etapas sem habilidades adicionais, reduzindo custos de tokens e complexidade de configuração.

Cadeias de fallback do OpenClaw preservam o tempo de atividade, mas podem reduzir silenciosamente a confiabilidade
O mecanismo de fallback de modelos do OpenClaw pode mascarar problemas de confiabilidade. Um modelo de fallback menor pode passar em tarefas simples, mas falhar em tarefas complexas, custando mais em novas tentativas e revisão.

Usando o Claude para analisar padrões de escrita para instruções personalizadas melhores
Um usuário do Reddit descreve um método para criar instruções personalizadas mais eficazes, fazendo o Claude analisar 10 amostras de escrita para identificar padrões concretos, como evitar pontuação e fontes de analogias, em vez de depender de descrições subjetivas de tom.

Opus 4.7 quebrou 40% dos prompts; a correção foi estruturar CLAUDE.md e Skills
Após o Opus 4.7 degradar ~40% dos prompts em 6 configurações, um head fractional de IA resolveu substituindo prompts ad-hoc por arquivos Skill estruturados, CLAUDE.md hierárquico e arquivos de memória separados — reduzindo o uso de tokens em 22% e as iterações de 3-4 para 1-2.