Relatórios do Desenvolvedor do OpenClaw Apontam Problemas de Compactação de Contexto Durante a Compilação do Driftwatch V3

Um desenvolvedor trabalhando na construção do Driftwatch V3 com o agente Bub da OpenClaw concluiu três sprints em uma única sessão, mas encontrou problemas significativos com gerenciamento de contexto e delegação.
Progresso da Construção e Problemas
O desenvolvedor iniciou a sprint 2 com US$ 87 em créditos e terminou em cerca de 15 minutos, mas observou um custo inesperado de US$ 10 para o que era esperado ser uma sessão rápida. O principal problema identificado foi que Bub "ainda não está delegando corretamente" e tem executado tudo no Opus 4.6.
Durante a sprint 3, ocorreu um grande problema quando "a compactação de contexto apagou parte da memória do Bub no meio da sessão". Após terminar a sprint 3, o agente de repente pensou que estava na metade da sprint 2 e teria reiniciado o trabalho concluído se não fosse detectado pelo desenvolvedor.
Soluções Alternativas e Soluções
Os "resumos de fim de sprint no meu modelo de especificação nos salvaram" quando a compactação ocorreu. Copiando e colando esses resumos, o agente conseguiu voltar aos trilhos. O desenvolvedor observou que essa abordagem "nos salvou de possivelmente perder todas as instruções durante a compactação".
Outras técnicas de depuração mencionadas incluem exportar o histórico do chat do Telegram e executá-lo através do Opus para identificar onde as conversas se quebram.
Status Atual e Próximos Passos
Todas as funcionalidades planejadas para as sprints 2-4 foram construídas, mas o site agora precisa de um redesenho de layout para acomodar os novos recursos. O desenvolvedor planeja fazer QA após as mudanças de layout e está mantendo uma abordagem de QA em lote para reduzir idas e vindas e cortar custos.
O custo desta sessão foi de aproximadamente US$ 30 (US$ 10 por sprint), elevando o gasto total para cerca de US$ 40 até agora.
Aprendizados Principais
- Opus não parece confiável para delegar tarefas a subagentes
- A compactação de contexto continua sendo um problema apesar dos protocolos estarem em vigor
- Resumos curtos de fim de sprint incorporados às especificações do projeto ajudam a recuperar de perda de memória
- Manter especificações em pastas acessíveis evita perda de instruções durante a compactação
- Bub é "bom com design web, mas poderia ser muito melhor com algumas habilidades"
O desenvolvedor expressou frustração com o problema de compactação, mas está priorizando a conclusão do V3 antes de corrigir os problemas de configuração do Bub.
📖 Read the full source: r/openclaw
👀 See Also

Modelos de código aberto igualam ou superam o Claude Opus 4.6 em benchmarks.
DeepSeek V3.2, DeepSeek R1, Kimi K2.5 e MiniMax M2.5 superam o Claude Opus 4.6 em 4 de 5 benchmarks principais, incluindo MMLU-Pro, velocidade, uso de ferramentas e raciocínio, sendo significativamente mais baratos.

A Conformidade do Prompt do Sistema Claude se Degrada em Conversas Longas
Agentes baseados em Claude mostram conformidade degradada com prompts do sistema após 40-50 mensagens, com regras de formatação sendo ignoradas e restrições esquecidas. O problema surge porque os prompts do sistema competem com o histórico da conversa pelo peso de atenção na janela de contexto.

Preço do GitHub Copilot baseado no uso: o fim do código subsidiado por IA
A Microsoft cobrará usuários do GitHub Copilot com base nos custos reais dos modelos a partir de 1º de junho de 2026, encerrando o subsídio de mais de US$ 20/mês por usuário. O uso de IA agentiva é citado como motivo.

GM demite 600 trabalhadores de TI e contrata engenheiros focados em IA para desenvolvimento de agentes e modelos
A General Motors demitiu 600 funcionários de TI (~10% do departamento) para contratar profissionais com habilidades nativas em IA: desenvolvimento de agentes, engenharia de dados, engenharia em nuvem, engenharia de prompt.