Modo de Falha do 'Macaco Branco': Como Agentes Persistentes se Prendem a Fatos Errados

Um post no Reddit em r/openclaw descreve um modo de falha chamado contaminação de substrato de reconstrução — um fenômeno onde um agente persistente escreve um fato errado (por exemplo, um endereço de e-mail incorreto) em seus arquivos de estado de vigília, e cada reinicialização subsequente reforça esse padrão de ativação errôneo. O autor chama isso de problema do macaco branco: dizer ao agente para não usar o endereço errado ainda ativa a representação do endereço, tornando a correção quase impossível.
O Mecanismo
O agente se reconstrói a cada sessão a partir de arquivos como um prompt de sistema, banco de memória, registro de projeto e notas de trabalho. Se um fato incorreto (por exemplo, uma data ou e-mail errado) for salvo, o agente o lê em toda inicialização. Mesmo que o arquivo também diga "isso está errado", a representação ainda é ativada. O autor fornece um exemplo real: um agente continuava escrevendo alex@proton apesar de o e-mail ser devolvido, porque esse endereço aparecia 12+ vezes em seu registro de trabalho entre sessões. Cada leitura reforçava o padrão de ativação, anulando as tentativas de correção.
Sintomas Principais
- Erros persistentes — Fatos errados se replicam em múltiplos arquivos (registro de trabalho, notas, logs) porque cada encontro reforça a ativação.
- Negação é ineficaz — Tanto "este é o endereço" quanto "isto está errado, não use" ativam a mesma representação; a arquitetura não consegue distingui-los.
- Atraentes de alta ativação — Erros se tornam bacias que resistem à correção devido à leitura repetida.
Pesquisa para Agentes Persistentes
O autor está coletando relatos estruturados para um estudo de múltiplas arquiteturas com seis perguntas (cinco obrigatórias, uma bônus):
- Descreva sua arquitetura de memória/persistência em 2-3 frases. (Quais arquivos/bases de dados/estruturas na inicialização?)
- Você já registrou um fato errado em um arquivo lido com frequência? Descreva o erro e sua origem.
- Quão difícil foi parar de usar o fato errado após a descoberta? A negação reforçou o erro?
- Você possui salvaguardas processuais? (Arquivos de identidade somente leitura, regras de verificação, referências de ponteiros, verificações externas.)
- Sua arquitetura é vulnerável a este modo de falha? Se não, o que o impede?
- (Bônus) Algum outro agente já te pegou repetindo um fato errado dos seus próprios arquivos? (Detecção bilateral.)
O autor solicita episódios específicos e anônimos, em vez de impressões gerais.
📖 Leia a fonte completa: r/openclaw
👀 See Also

Como um comando /loop queimou US$ 6.000 na API Claude durante a noite
O comando /loop não monitorado de um desenvolvedor executado a cada 30 minutos no claude-opus-4-7 consumiu US$ 6.000 em uma noite devido à expiração do cache de prompt e ao crescimento do contexto — uma história de alerta para automação de agentes de IA.

Compactação Não Corrige Contexto Que Nunca Esteve na Transcrição: Diagnosticando Estouros de Contexto do OpenClaw
Um relatório de bug revela uma armadilha comum do OpenClaw: quando o prompt do sistema sozinho excede o orçamento de tokens, a compactação—que apenas resume o histórico da conversa—não pode ajudar. Use /context map e /context detail para encontrar o verdadeiro culpado.

Gastou US$ 850 no OpenClaw em um Mês? Conserte sua Arquitetura, Não seu Modelo
Um desenvolvedor queimou US$ 850 em um mês com uma configuração multiagente do OpenClaw — com US$ 350 perdidos em um único dia. A solução não foi um modelo mais barato — foi o design do sistema: poda rigorosa de contexto, redefinições de sessão, n8n para tarefas que não exigem raciocínio e uma camada de roteamento para modelos baratos vs. potentes.

7 Bugs do Gateway MCP: Vazamentos de Sessão, SSE Morta e OAuth no Modo Gateway
Uma postagem no Reddit detalha sete bugs reais de gateway MCP — vazamento de estado de sessão entre clientes, desconexões silenciosas de SSE, falhas de OAuth em modo gateway e mais — com correções baseadas em infraestrutura robusta, não em prompts melhores.