Como evitar custos inesperados do OpenRouter na automação do OpenClaw

Uma equipe de desenvolvedores compartilhou sua experiência de gastar acidentalmente US$ 750 em três dias ao executar pipelines de automação no OpenClaw com OpenRouter. O custo veio de 25 recargas automáticas do OpenRouter a US$ 28,96 cada, mais US$ 25 na API do X.
O que deu errado
A equipe construiu um pipeline de automação de 12 a 14 de março que incluía geração de palpites esportivos, produção de vídeo, QA e distribuição. Cron jobs rodavam conforme agendado com subagentes sendo criados para cada tarefa. Tudo usava Claude Sonnet 4.6 como padrão a US$ 3 por milhão de tokens sem o conhecimento deles. Um cron job de 6 minutos para palpites esportivos com buscas na web queimou aproximadamente US$ 120 em uma única execução.
A solução: redução de 97% nos custos
Com mudanças de configuração, a mesma carga de trabalho agora custa cerca de US$ 15-20. Aqui estão as alterações específicas que fizeram:
- Alteraram o modelo padrão: No openclaw.json, trocaram o padrão caro por Hunter Alpha (gratuito no OpenRouter):
"agents": { "defaults": { "models": { "default": "openrouter/hunter-alpha", "fast": "openrouter/hunter-alpha", "thinking": "openrouter/openrouter/hunter-alpha" } } } - Bloquearam cron jobs para um modelo barato: Cron jobs herdam o que for padrão. Sobrescreva-os explicitamente com:
Faça isso para cada cron job.openclaw cron edit--model "openrouter/hunter-alpha" - Bloquearam criações de subagentes: Subagentes também herdam padrões. Ao criar, especifique o modelo:
sessions_spawn(..., model="openrouter/hunter-alpha") - Reservaram modelos caros para trabalhos sensíveis: Mantiveram Claude 3.5 Haiku (US$ 0,25/milhão) para qualquer coisa envolvendo credenciais ou dados pessoais devido à política de privacidade da Anthropic (sem registro de prompts). Usam Gemini 2.5 Flash (US$ 0,15/milhão) quando precisam de raciocínio mais complexo. Sonnet está efetivamente aposentado de sua configuração, a menos que seja chamado explicitamente.
Lições aprendidas
- Verifique seu modelo padrão imediatamente. Se for um modelo premium, cada sessão, cron e subagente está queimando dinheiro.
- Cron jobs são sorrateiros - rodam silenciosamente no agendamento e podem custar US$ 100+ por execução sem aviso.
- Criações de subagentes herdam padrões. Se sua sessão principal está no Sonnet e você cria 10 subagentes, todos os 10 estão no Sonnet, a menos que especificado de outra forma.
- Hunter Alpha é gratuito mas NÃO é privado - todos os prompts são registrados. Não use para dados financeiros, credenciais ou qualquer coisa sensível.
- Modelos caros valem a pena como opções, não como padrões. Sonnet não deve rodar seus cron jobs às 3 da manhã.
- Fique de olho no seu e-mail - essas recargas de US$ 28,96 do OpenRouter se acumulam rapidamente.
Conclusão: OpenClaw é poderoso, mas não segura sua mão nos custos. Algumas linhas de configuração podem ser a diferença entre um pipeline de automação de US$ 15 e uma surpresa de US$ 750.
📖 Read the full source: r/openclaw
👀 See Also

Como executar agentes OpenClaw gratuitamente usando APIs em nuvem ou modelos locais
Um guia detalhado explica como executar agentes OpenClaw sem custo algum usando camadas gratuitas de nuvem do OpenRouter, Gemini e Groq, ou executando modelos locais via Ollama com dicas de configuração específicas para evitar armadilhas comuns.

Execute o OpenClaw com um LLM Local no macOS – Guia para 16–24GB de RAM
Um guia prático para configurar um modelo Qwen 3.5 quantizado com OpenClaw no macOS (16–24 GB de RAM), incluindo uma habilidade de teste para verificação.

Seu LLM Não Deveria Ser Seu Fluxo de Trabalho de Agente de Codificação: Separação de Preocupações no OpenClaw
Se o seu fluxo de trabalho com agente de codificação parar ao atingir o limite de uso do LLM, o LLM está fazendo demais. Mantenha filas, estado, tentativas e verificação determinísticas—chame o LLM apenas para julgamento.

Benchmarks de 12GB VRAM: Executando Modelos Qwen 3.6 e Gemma 4 em uma RTX 4070 Super
Um usuário do Reddit compartilha benchmarks detalhados de velocidade para Qwen3.6-35B-A3B, Qwen3.6-27B, Gemma 4 26B e Gemma 4 31B em uma RTX 4070 Super de 12 GB usando llama.cpp com configurações otimizadas.