Soyez Mon Majordome : Pipeline Multi-Agent pour la Vérification de Code IA

Ce que fait Be My Butler
Be My Butler (BMB) est un pipeline multi-agents conçu pour résoudre un problème spécifique dans le codage assisté par IA : lorsque les agents de codage IA signalent incorrectement leur propre code comme fonctionnel. Le créateur, un ingénieur en matériaux/mécanique sans formation en programmation, a construit cela après avoir constaté que les agents Claude Code écrivaient du code qui passait les tests mais ne fonctionnait pas réellement en pratique.
Concept central
Le système met en œuvre un modèle de révision par les pairs pour le code généré par l'IA :
- Un modèle écrit le code
- Un modèle différent le révise sans savoir qui l'a écrit (vérification aveugle)
- Un conseil inter-modèles (Claude + GPT + Gemini) vote pour déterminer s'il fonctionne réellement
- Un agent analyste suit les modèles de ce qui ne fonctionne pas
Métriques de performance
D'après les tests :
- L'auto-révision par agent unique détecte ~40 % des vrais problèmes
- La révision aveugle inter-modèles détecte ~85 %
- Surcharge de coût : 15-20 % de tokens supplémentaires
Fonctionnalités v0.2
- Tableau de bord analytique pour suivre l'utilisation des tokens et les coûts
- Agent analyste pour les modèles de révision de code automatisée
- Agent consultant pour les décisions d'architecture
- Orchestration améliorée basée sur tmux
Installation et utilisation
Entièrement open source sous licence MIT. Installation :
git clone https://github.com/project820/be-my-butler.git
cd be-my-butler && ./install.sh
bmb "build a REST API with auth"L'outil est particulièrement utile pour les "codeurs à l'intuition" — les personnes sans expérience traditionnelle en codage qui dépendent de l'IA pour l'évaluation de la qualité du code. Lorsque vous ne pouvez pas lire le code pour repérer vous-même les problèmes, avoir plusieurs modèles qui se vérifient mutuellement fournit une vérification que les systèmes à agent unique n'offrent pas.
📖 Read the full source: r/ClaudeAI
👀 See Also

Plugin de reclassement externe pour OpenClaw Memory-Core : réutiliser les anciens GPU
Un développeur partage un plugin pour OpenClaw qui permet à memory-core d'utiliser un reranker externe au lieu du QMD intégré, améliorant les performances sur les configurations limitées en CPU.
Norme matérielle des modèles d’Anthropic : les agents IA disposent d’un pilote unifié pour les appareils de laboratoire et d’usine
L'aperçu du Model Hardware Standard (MHS) d'Anthropic donne aux agents IA un pilote standardisé pour faire fonctionner des instruments de laboratoire et de fabrication, réduisant le temps d'intégration de semaines à quelques minutes.

Netflix publie VOID : un modèle de suppression d'objets et d'interactions vidéo sur Hugging Face
Netflix a publié VOID, un modèle de vidéo-inpainting qui supprime des objets des vidéos ainsi que toutes les interactions physiques qu'ils induisent, y compris les objets qui tombent et les éléments déplacés. Le modèle nécessite un GPU avec 40 Go+ de VRAM et utilise un conditionnement par quadmask avec deux fichiers de point de contrôle pour différents niveaux de raffinement.

OpenClaw Alexa Voice Proxy Permet une Interaction Vocale Bidirectionnelle
openclaw-alexa-voice est un proxy Node.js qui connecte une Alexa Custom Skill à la passerelle OpenClaw avec un système de réponse à trois niveaux pour les requêtes vocales. Il gère les réponses rapides en moins d'une seconde, les réponses d'agent en moins de 12 secondes, et les requêtes complexes différées traitées de manière asynchrone en moins de 2 minutes.