Sé Mi Mayordomo: Tubería Multi-Agente para Verificación de Código con IA

Qué hace Be My Butler
Be My Butler (BMB) es una canalización multiagente diseñada para resolver un problema específico en la programación asistida por IA: cuando los agentes de programación de IA informan incorrectamente que su propio código funciona. El creador, un ingeniero de materiales/mecánico sin formación en programación, construyó esto después de experimentar que los agentes Claude Code escribían código que pasaba las pruebas pero que en realidad no funcionaba en la práctica.
Concepto central
El sistema implementa un modelo de revisión por pares para el código generado por IA:
- Un modelo escribe el código
- Un modelo diferente lo revisa sin saber quién lo escribió (verificación ciega)
- Un consejo de modelos cruzados (Claude + GPT + Gemini) vota sobre si realmente funciona
- Un agente analista rastrea patrones en lo que sale mal
Métricas de rendimiento
De las pruebas:
- La autorrevisión de un solo agente detecta aproximadamente el 40% de los problemas reales
- La revisión ciega entre modelos detecta aproximadamente el 85%
- Sobrecosto: 15-20% más de tokens
Características de la v0.2
- Panel de análisis para rastrear el uso de tokens y los costos
- Agente analista para patrones automatizados de revisión de código
- Agente consultor para decisiones de arquitectura
- Orquestación mejorada basada en tmux
Instalación y uso
Completamente de código abierto bajo licencia MIT. Instalación:
git clone https://github.com/project820/be-my-butler.git
cd be-my-butler && ./install.sh
bmb "build a REST API with auth"La herramienta es particularmente útil para "programadores por vibra" — personas sin experiencia tradicional en programación que dependen de la IA para evaluar la calidad del código. Cuando no puedes leer el código para detectar problemas por ti mismo, tener múltiples modelos que se verifiquen entre sí proporciona una verificación que carecen los sistemas de un solo agente.
📖 Read the full source: r/ClaudeAI
👀 Ver también

claude-powerline v1.20 agrega el modo de panel de control TUI, estilos de barra de contexto y visualización de variables de entorno.
claude-powerline v1.20 presenta un modo de panel TUI que reemplaza la línea de estado única con un panel completo que muestra información del modelo, uso del contexto con barra de progreso, costos, estado de git y más. La actualización añade 9 estilos visuales de barras de progreso para el uso del contexto y capacidad de mostrar variables de entorno.

Solución para la pérdida de memoria de OpenClaw usando el complemento Mem0.
Los agentes de OpenClaw experimentan pérdida de memoria debido a la compactación de contexto que reescribe archivos como MEMORY.md. El complemento Mem0 soluciona esto moviendo la memoria fuera de la ventana de contexto con funciones de recuperación automática y captura automática.

Pilot Shell: Una Capa de Flujo de Trabajo Estructurada para Claude Code
Pilot Shell añade flujos de trabajo TDD guiados por especificaciones, hooks de calidad, ingeniería de contexto y optimización de tokens sobre Claude Code, sin la complejidad de los frameworks multiagente.

Argyph: Un Servidor MCP Único para Claude Code con 19 Herramientas Estructuradas de Comprensión de Código
Argyph es un servidor MCP local que le da a Claude Code 19 herramientas — ir a definición, buscar referencias, grafos de llamadas, búsqueda semántica, empaquetado de repositorio con presupuesto de tokens — reemplazando múltiples servidores MCP separados con una sola instalación. No requiere clave API; todo el procesamiento permanece en tu máquina.