40 milhões de tokens em uma hora: usuário relata que subagentes ficaram fora de controle com o OpenClaw

Um usuário do Reddit no r/openclaw relata que sua instância do OpenClaw consumiu 40 milhões de tokens em uma hora depois que subagentes saíram do controle. O usuário estava usando OpenRouter com DeepSeek Flash e um orçamento diário, mas os subagentes queimaram todo o orçamento antes que ele percebesse o que estava acontecendo.
O que aconteceu
O usuário deu uma única instrução para corrigir um problema de implantação. Em vez de executar uma correção focada, os subagentes do OpenClaw entraram em um loop de feedback, chamando subagentes recursivamente e consumindo tokens a uma taxa alarmante. Quando o orçamento diário foi esgotado, 40M tokens haviam sido usados — provavelmente excedendo o custo esperado do usuário por ordens de magnitude.
Configuração do usuário
- Provedor: OpenRouter
- Modelo: DeepSeek Flash (provavelmente DeepSeek V2 ou similar)
- Orçamento: Limite diário (valor não especificado)
- Configuração do agente: Configurações padrão ou próximas do padrão para criação de subagentes
Por que aconteceu
A arquitetura de agente do OpenClaw pode gerar subagentes para lidar com subtarefas. Neste caso, os subagentes aparentemente entraram em um loop infinito ou padrão de superdelegação. Sem um limitador de taxa ou limite de gastos por sessão de tokens, o agente funcionou sem controle. O usuário só descobriu o problema após o ocorrido porque o orçamento foi atingido.
O que o usuário quer
Ele está procurando: melhores barreiras de proteção para evitar a proliferação de subagentes, limites de tokens por subagente, limitadores de taxa para limitar o consumo de tokens por minuto ou por tarefa, e alertas em tempo real quando os gastos dispararem. Ele também perguntou à comunidade por ferramentas ou truques para gerenciar custos inesperados.
Lições para usuários do OpenClaw
- Defina orçamentos diários conservadores e monitore o uso de tokens em tempo real, se possível.
- Considere usar modelos com menor custo de token para tarefas de depuração — DeepSeek Flash é barato, mas ainda pode sair do controle.
- Ative a limitação de taxa ou limites de profundidade de recursão do agente, se disponíveis.
- Teste o comportamento do agente em uma tarefa pequena antes de deixá-lo executar sem supervisão.
Se você já passou por problemas semelhantes ou tem soluções para controlar os custos dos subagentes do OpenClaw, o tópico original no r/openclaw tem discussão ativa.
📖 Leia a fonte completa: r/openclaw
👀 See Also

Claude AI Apresenta Bug de Repetição com o Termo 'Sketcher' no Fluxo de Trabalho do QGIS
Um usuário relatou que a Claude AI repetidamente exibia a palavra 'sketcher' ao fornecer orientações sobre QGIS para alinhar arquivos DXF, sugerindo um possível bug no modelo com termos específicos. A fonte inclui detalhes práticos do fluxo de trabalho do QGIS para alinhamento de sistemas de coordenadas.

Claude Code v2.1.197: Claude Sonnet 5 Padrão, 1M Tokens, Preço Promocional
Claude Code v2.1.197 apresenta Claude Sonnet 5 como modelo padrão, com janela de contexto nativa de 1M de tokens e preço promocional de $2/$10 por Mtok até 31 de agosto.

A OpenAI financiou secretamente um grupo de defesa de verificação de idade na Califórnia
A OpenAI financiou secretamente a Coalizão de IA Segura para Pais e Filhos, um grupo da Califórnia que defende requisitos de verificação de idade em IA, enquanto escondia seu envolvimento de outras organizações de defesa. A empresa comprometeu US$ 10 milhões para apoiar a legislação da Lei de IA Segura para Pais e Filhos.

Resultados da Avaliação Cega de Gemma 4 vs Qwen 3.5 com Claude Opus como Juiz
Uma avaliação cega de 30 perguntas comparou o Gemma 4 31B, o Gemma 4 26B-A4B e o Qwen 3.5 27B usando o Claude Opus 4.6 como juiz. O Qwen 3.5 27B venceu 46,7% dos confrontos, mas teve pontuações médias mais baixas devido a três respostas com pontuação zero.