40 milhões de tokens em uma hora: usuário relata que subagentes ficaram fora de controle com o OpenClaw

Um usuário do Reddit no r/openclaw relata que sua instância do OpenClaw consumiu 40 milhões de tokens em uma hora depois que subagentes saíram do controle. O usuário estava usando OpenRouter com DeepSeek Flash e um orçamento diário, mas os subagentes queimaram todo o orçamento antes que ele percebesse o que estava acontecendo.
O que aconteceu
O usuário deu uma única instrução para corrigir um problema de implantação. Em vez de executar uma correção focada, os subagentes do OpenClaw entraram em um loop de feedback, chamando subagentes recursivamente e consumindo tokens a uma taxa alarmante. Quando o orçamento diário foi esgotado, 40M tokens haviam sido usados — provavelmente excedendo o custo esperado do usuário por ordens de magnitude.
Configuração do usuário
- Provedor: OpenRouter
- Modelo: DeepSeek Flash (provavelmente DeepSeek V2 ou similar)
- Orçamento: Limite diário (valor não especificado)
- Configuração do agente: Configurações padrão ou próximas do padrão para criação de subagentes
Por que aconteceu
A arquitetura de agente do OpenClaw pode gerar subagentes para lidar com subtarefas. Neste caso, os subagentes aparentemente entraram em um loop infinito ou padrão de superdelegação. Sem um limitador de taxa ou limite de gastos por sessão de tokens, o agente funcionou sem controle. O usuário só descobriu o problema após o ocorrido porque o orçamento foi atingido.
O que o usuário quer
Ele está procurando: melhores barreiras de proteção para evitar a proliferação de subagentes, limites de tokens por subagente, limitadores de taxa para limitar o consumo de tokens por minuto ou por tarefa, e alertas em tempo real quando os gastos dispararem. Ele também perguntou à comunidade por ferramentas ou truques para gerenciar custos inesperados.
Lições para usuários do OpenClaw
- Defina orçamentos diários conservadores e monitore o uso de tokens em tempo real, se possível.
- Considere usar modelos com menor custo de token para tarefas de depuração — DeepSeek Flash é barato, mas ainda pode sair do controle.
- Ative a limitação de taxa ou limites de profundidade de recursão do agente, se disponíveis.
- Teste o comportamento do agente em uma tarefa pequena antes de deixá-lo executar sem supervisão.
Se você já passou por problemas semelhantes ou tem soluções para controlar os custos dos subagentes do OpenClaw, o tópico original no r/openclaw tem discussão ativa.
📖 Leia a fonte completa: r/openclaw
👀 See Also

Acesso à IA de Fronteira se Aperta: O Mito da Anthropic e a Mudança Estrutural para Lançamentos Seletivos
O modelo de cibersegurança Mythos da Anthropic e a iniciativa Daybreak da OpenAI sinalizam uma nova era em que restrições econômicas e de segurança limitam a IA de ponta a empresas selecionadas sediadas nos EUA, impulsionadas por riscos de uso indevido, ameaças de destilação e controles governamentais emergentes.

Waymo Lança Operações Totalmente Autônomas com Motorista de 6ª Geração
O Driver de 6ª geração da Waymo inicia operações totalmente autônomas, apresentando um conjunto de sensores multi-modais e imagens de próxima geração de 17 megapixels.

Projeto de Lei Schiff-Rounds LIFT AI: O que os Desenvolvedores Precisam Saber sobre o Projeto de Alfabetização em IA para o Ensino Básico
OpenAI, Google e Microsoft apoiam o LIFT AI Act, que financia concessões da NSF para currículos de alfabetização em IA para o K-12, formação de professores e ferramentas de avaliação.

Macs para LLM Local e OpenClaw: Gargalo de Processamento de Prompt Torna Nuvem Mais Barata
Um desenvolvedor relata que Macs são lentos para processamento de prompt em comparação com GPUs Nvidia, tornando modelos em nuvem como Deepseek mais econômicos para agentes de IA, a menos que a privacidade exija inferência local.