Architecture de Validation Froide : Système de Revue de Code à Double Agent Libéré en Open Source

L'Architecture de Validation Froide est un système open source qui met en œuvre une validation à double agent pour le code généré par IA. Un agent écrit le code, tandis qu'un agent séparé le révise indépendamment sans accès au raisonnement ou au contexte du constructeur.
Fonctionnement
Le système aborde le biais d'auto-révision à agent unique en appliquant une séparation des tâches similaire aux audits indépendants. Le réviseur opère en isolation complète du processus de réflexion du constructeur.
Phases du flux de travail
- Écrire le plan →
/review-plan(Porte A) - Implémenter →
/review-impl(Porte C) - Livrer →
/acceptance-report(Porte D)
Détails clés de mise en œuvre
- Le réviseur s'exécute dans un répertoire temporaire isolé
- Le réviseur ne voit que : le document de plan, la différence de code et la sortie des tests
- Les constatations persistent avec des empreintes pour le suivi
- Le constructeur peut être en désaccord avec la justification du réviseur
- Maximum 2 tours par phase
- Construit avec des scripts bash et des schémas JSON
- Fonctionne actuellement avec Claude Code + Codex CLI
- Le modèle est agnostique aux agents (peut fonctionner avec différents agents IA)
Spécifications techniques
Le système est implémenté sous forme de scripts bash qui coordonnent deux agents IA distincts. Des schémas JSON définissent la structure des documents de plan, des revues de code et des rapports d'acceptation. L'environnement d'exécution isolé garantit que le réviseur n'a accès ni au raisonnement interne du constructeur ni aux étapes intermédiaires.
Cette approche est utile pour les développeurs qui souhaitent mettre en œuvre une validation plus rigoureuse du code généré par IA, en particulier lorsqu'ils travaillent sur des systèmes complexes où l'auto-révision à agent unique pourrait introduire un biais de confirmation.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

Version open source de CLAUDE.md garde les agents Claude Code productifs pendant des heures, sans boucles
Un seul fichier CLAUDE.md de 70 lignes empêche les agents Claude Code de dériver dans la narration et de boucler sur les correctifs. Les sessions passent de 3 heures d'échec à des cycles de productivité complets.

Création d'un cycle de rêve auto-améliorant avec les tâches Cron et Claude
Un développeur a créé un cycle de rêve autonome en utilisant deux tâches cron : l'une à 22h30 pour la recherche et la réflexion, et l'autre à 23h00 pour la revue et la planification. Le système scanne arXiv, GitHub trending et Reddit, identifie les faiblesses et propose des améliorations concrètes.

quorum : l'outil de gouvernance du code IA impose un examen indépendant des modèles
quorum est une couche de gouvernance pour le développement assisté par IA qui applique un protocole de consensus exigeant que le code soit examiné indépendamment par un modèle différent avant validation. Il comprend trois barrières structurelles qui bloquent la progression : les barrières d'audit, de rétrospective et de qualité.

Codebase Memory MCP : Exploration de code basée sur des graphes pour Claude Code
Un développeur a créé un serveur MCP qui indexe des bases de code dans un graphe de connaissances persistant en utilisant Tree-sitter et SQLite, réduisant l'utilisation de tokens par 20x en moyenne pour les requêtes structurelles comme le traçage d'appels et la détection de code mort.