Loop de Revisão Intermodelo para Agentes de Codificação de IA Detecta Falhas Críticas de Planejamento

✍️ OpenClawRadar📅 Publicado: April 16, 2026🔗 Source
Loop de Revisão Intermodelo para Agentes de Codificação de IA Detecta Falhas Críticas de Planejamento
Ad

Como Funciona a Revisão entre Modelos

Um desenvolvedor no r/ClaudeAI criou um sistema que aborda um problema comum com agentes de IA de codificação como Codex, Claude Code e Cursor: os planos são executados sem que ninguém questione suas premissas primeiro. A solução encaminha cada plano através de um segundo modelo de IA com arquitetura e dados de treinamento diferentes antes que a execução comece.

Detalhes Principais da Implementação

O modelo revisor é somente leitura e não pode tocar no código—ele só pode questionar o plano. Essa restrição é crítica porque "no momento em que pode editar, ele para de ser um crítico e começa a comprometer". O sistema executa um loop automático com um limite de rodadas: os planos voltam para revisão se problemas forem encontrados até que sejam aprovados ou atinjam o limite.

O que o Sistema Identifica

  • Planos de reversão que na verdade não revertem
  • Projetos de permissão com brechas de segurança reais
  • Portões de revisão tomando decisões de prosseguir/parar com base em estado desatualizado
  • Planos de múltiplas etapas que parecem coerentes até um segundo modelo percorrer todo o fluxo
Ad

Decisões Críticas de Design

  • Contexto de revisão delimitado impede que o revisor perca tempo lendo partes irrelevantes do repositório
  • Personas do revisor (risco de entrega, reprodutibilidade, custo de desempenho, conformidade de segurança) identificam diferentes tipos de problemas
  • Um painel TUI ao vivo mostra fase, rodada, veredito, gravidade, custo e histórico em uma única visualização de terminal
  • O sistema funciona com diferentes planejadores: Claude Code usa um gancho nativo ExitPlanMode enquanto Codex e outros orquestradores usam um portão explícito

Resultados Práticos

O desenvolvedor usou o sistema para ajudar a construí-lo: "Codex planejou, Claude revisou os planos, e o design convergiu através de múltiplas rodadas." A ferramenta é licenciada sob MIT e disponível como rival-review no GitHub.

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

Automatizando a Triagem de Alertas do Datadog com Claude Code e MCP
Tools

Automatizando a Triagem de Alertas do Datadog com Claude Code e MCP

Um desenvolvedor criou um sistema usando as habilidades do Claude Code e o servidor MCP do Datadog para verificar automaticamente alertas de monitoramento, classificar problemas e abrir PRs de correção via cron job. A configuração leva cerca de 30 minutos e executa agentes de IA em paralelo em worktrees isolados.

OpenClawRadar
Sistema de auditoria automática de 4 camadas para evolução comportamental do OpenClaw
Tools

Sistema de auditoria automática de 4 camadas para evolução comportamental do OpenClaw

Um desenvolvedor construiu um sistema de auditoria de 4 camadas onde o Gemini revisa os pontos cegos do Claude semanalmente, capturando padrões que o Claude perdeu na autoavaliação. O sistema inclui verificação pós-correção, mineração de padrões, espelhamento externo e verificações de expectativa versus realidade.

OpenClawRadar
ToolLoop: Framework de Código Aberto para Ferramentas no Estilo Claude com Qualquer LLM
Tools

ToolLoop: Framework de Código Aberto para Ferramentas no Estilo Claude com Qualquer LLM

ToolLoop é um framework Python de código aberto com 11 ferramentas para operações de arquivo, busca de código, acesso ao shell e subagentes que funciona com qualquer LLM através do LiteLLM. O framework de 2.700 linhas permite trocar de modelo no meio da conversa mantendo o contexto compartilhado.

OpenClawRadar
🦀
Tools

Agentalmanac: Um Catálogo de 23 Servidores MCP com Configurações JSON Prontas para Copiar

Usuário do Reddit cataloga 23 servidores MCP com configurações prontas para colar no Claude Desktop, Cursor e Continue. Contorna servidores arquivados por alternativas mantidas. Demonstração hospedada roda em Cloudflare Workers.

OpenClawRadar