Seja Meu Mordomo: Pipeline Multi-Agente para Verificação de Código em IA

✍️ OpenClawRadar📅 Publicado: March 14, 2026🔗 Source
Seja Meu Mordomo: Pipeline Multi-Agente para Verificação de Código em IA
Ad

O que o Be My Butler faz

Be My Butler (BMB) é um pipeline de múltiplos agentes projetado para resolver um problema específico na codificação assistida por IA: quando agentes de codificação de IA relatam incorretamente seu próprio código como funcionando. O criador, um engenheiro de materiais/mecânico sem formação em programação, construiu isso após experimentar agentes Claude Code escrevendo código que passava nos testes, mas não funcionava na prática.

Conceito Central

O sistema implementa um modelo de revisão por pares para código gerado por IA:

  • Um modelo escreve o código
  • Um modelo diferente o revisa sem saber quem o escreveu (verificação cega)
  • Um conselho entre modelos (Claude + GPT + Gemini) vota se ele realmente funciona
  • Um agente analista rastreia padrões no que dá errado

Métricas de Desempenho

De testes:

  • Auto-revisão de agente único detecta ~40% dos problemas reais
  • Revisão cega entre modelos detecta ~85%
  • Sobrecusto: 15-20% mais tokens
Ad

Recursos da v0.2

  • Painel de análise para rastrear uso de tokens e custos
  • Agente analista para padrões automatizados de revisão de código
  • Agente consultor para decisões de arquitetura
  • Orquestração aprimorada baseada em tmux

Instalação e Uso

Totalmente de código aberto sob licença MIT. Instalação:

git clone https://github.com/project820/be-my-butler.git
cd be-my-butler && ./install.sh
bmb "build a REST API with auth"

A ferramenta é particularmente útil para "codificadores por vibração" — pessoas sem experiência tradicional em codificação que dependem da IA para avaliação da qualidade do código. Quando você não consegue ler código para identificar problemas sozinho, ter vários modelos verificando uns aos outros fornece uma verificação que sistemas de agente único não possuem.

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

Duas Habilidades de Código do Claude para Gerenciar a Configuração CLAUDE.md
Tools

Duas Habilidades de Código do Claude para Gerenciar a Configuração CLAUDE.md

Um desenvolvedor criou duas habilidades Claude Code para lidar com a configuração do CLAUDE.md: /cc-init cria configurações enxutas para novos projetos, e /cc-optimize analisa projetos existentes em busca de bloat e problemas. Ambas visam reduzir a sobrecarga de contexto e melhorar o seguimento de instruções.

OpenClawRadar
Equipe do Crime: Orquestrador Multiagente para OpenClaw — Revisão de Código Paralela com Agente Codificador
Tools

Equipe do Crime: Orquestrador Multiagente para OpenClaw — Revisão de Código Paralela com Agente Codificador

Crime Team v0.1 executa múltiplos agentes especialistas OpenClaw em paralelo para revisão de código e depois integra os resultados. Inclui modelos por agente, um agente coder que aplica alterações e um loop de reauditoria. CLI + GUI.

OpenClawRadar
Tether: Um Servidor MCP para Compartilhar Contexto Entre Modelos de IA via SQLite
Tools

Tether: Um Servidor MCP para Compartilhar Contexto Entre Modelos de IA via SQLite

Tether é uma ferramenta de código aberto que compacta dados JSON em identificadores de 28 bytes endereçados por conteúdo, permitindo que múltiplos modelos de IA compartilhem contexto através de um banco de dados SQLite compartilhado. Funciona como um servidor MCP, possibilitando comunicação direta entre modelos como Claude e MiniMax sem necessidade de copiar e colar.

OpenClawRadar
Executador de Benchmark de Código Aberto para Testar Agentes OpenClaw em Fluxos de Trabalho Reais
Tools

Executador de Benchmark de Código Aberto para Testar Agentes OpenClaw em Fluxos de Trabalho Reais

Um novo projeto de código aberto permite que você compare agentes OpenClaw com suas próprias tarefas privadas e realistas definidas em YAML, com suporte para importar workspaces reais dos agentes.

OpenClawRadar