Loop de Revisão Intermodelo para Agentes de Codificação de IA Detecta Falhas Críticas de Planejamento

Como Funciona a Revisão entre Modelos
Um desenvolvedor no r/ClaudeAI criou um sistema que aborda um problema comum com agentes de IA de codificação como Codex, Claude Code e Cursor: os planos são executados sem que ninguém questione suas premissas primeiro. A solução encaminha cada plano através de um segundo modelo de IA com arquitetura e dados de treinamento diferentes antes que a execução comece.
Detalhes Principais da Implementação
O modelo revisor é somente leitura e não pode tocar no código—ele só pode questionar o plano. Essa restrição é crítica porque "no momento em que pode editar, ele para de ser um crítico e começa a comprometer". O sistema executa um loop automático com um limite de rodadas: os planos voltam para revisão se problemas forem encontrados até que sejam aprovados ou atinjam o limite.
O que o Sistema Identifica
- Planos de reversão que na verdade não revertem
- Projetos de permissão com brechas de segurança reais
- Portões de revisão tomando decisões de prosseguir/parar com base em estado desatualizado
- Planos de múltiplas etapas que parecem coerentes até um segundo modelo percorrer todo o fluxo
Decisões Críticas de Design
- Contexto de revisão delimitado impede que o revisor perca tempo lendo partes irrelevantes do repositório
- Personas do revisor (risco de entrega, reprodutibilidade, custo de desempenho, conformidade de segurança) identificam diferentes tipos de problemas
- Um painel TUI ao vivo mostra fase, rodada, veredito, gravidade, custo e histórico em uma única visualização de terminal
- O sistema funciona com diferentes planejadores: Claude Code usa um gancho nativo ExitPlanMode enquanto Codex e outros orquestradores usam um portão explícito
Resultados Práticos
O desenvolvedor usou o sistema para ajudar a construí-lo: "Codex planejou, Claude revisou os planos, e o design convergiu através de múltiplas rodadas." A ferramenta é licenciada sob MIT e disponível como rival-review no GitHub.
📖 Read the full source: r/ClaudeAI
👀 See Also

Automatizando a Triagem de Alertas do Datadog com Claude Code e MCP
Um desenvolvedor criou um sistema usando as habilidades do Claude Code e o servidor MCP do Datadog para verificar automaticamente alertas de monitoramento, classificar problemas e abrir PRs de correção via cron job. A configuração leva cerca de 30 minutos e executa agentes de IA em paralelo em worktrees isolados.

Sistema de auditoria automática de 4 camadas para evolução comportamental do OpenClaw
Um desenvolvedor construiu um sistema de auditoria de 4 camadas onde o Gemini revisa os pontos cegos do Claude semanalmente, capturando padrões que o Claude perdeu na autoavaliação. O sistema inclui verificação pós-correção, mineração de padrões, espelhamento externo e verificações de expectativa versus realidade.

ToolLoop: Framework de Código Aberto para Ferramentas no Estilo Claude com Qualquer LLM
ToolLoop é um framework Python de código aberto com 11 ferramentas para operações de arquivo, busca de código, acesso ao shell e subagentes que funciona com qualquer LLM através do LiteLLM. O framework de 2.700 linhas permite trocar de modelo no meio da conversa mantendo o contexto compartilhado.
Agentalmanac: Um Catálogo de 23 Servidores MCP com Configurações JSON Prontas para Copiar
Usuário do Reddit cataloga 23 servidores MCP com configurações prontas para colar no Claude Desktop, Cursor e Continue. Contorna servidores arquivados por alternativas mantidas. Demonstração hospedada roda em Cloudflare Workers.