Architecture de Validation Froide : Système de Revue de Code à Double Agent Libéré en Open Source

L'Architecture de Validation Froide est un système open source qui met en œuvre une validation à double agent pour le code généré par IA. Un agent écrit le code, tandis qu'un agent séparé le révise indépendamment sans accès au raisonnement ou au contexte du constructeur.
Fonctionnement
Le système aborde le biais d'auto-révision à agent unique en appliquant une séparation des tâches similaire aux audits indépendants. Le réviseur opère en isolation complète du processus de réflexion du constructeur.
Phases du flux de travail
- Écrire le plan →
/review-plan(Porte A) - Implémenter →
/review-impl(Porte C) - Livrer →
/acceptance-report(Porte D)
Détails clés de mise en œuvre
- Le réviseur s'exécute dans un répertoire temporaire isolé
- Le réviseur ne voit que : le document de plan, la différence de code et la sortie des tests
- Les constatations persistent avec des empreintes pour le suivi
- Le constructeur peut être en désaccord avec la justification du réviseur
- Maximum 2 tours par phase
- Construit avec des scripts bash et des schémas JSON
- Fonctionne actuellement avec Claude Code + Codex CLI
- Le modèle est agnostique aux agents (peut fonctionner avec différents agents IA)
Spécifications techniques
Le système est implémenté sous forme de scripts bash qui coordonnent deux agents IA distincts. Des schémas JSON définissent la structure des documents de plan, des revues de code et des rapports d'acceptation. L'environnement d'exécution isolé garantit que le réviseur n'a accès ni au raisonnement interne du constructeur ni aux étapes intermédiaires.
Cette approche est utile pour les développeurs qui souhaitent mettre en œuvre une validation plus rigoureuse du code généré par IA, en particulier lorsqu'ils travaillent sur des systèmes complexes où l'auto-révision à agent unique pourrait introduire un biais de confirmation.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

La chute silencieuse de Claude : l'échec de la couche d'action lorsque les agents IA investissent les sites d'affaires
Claude peut lire les sites web professionnels (tarifs, processus de réservation, formulaires) mais échoue au niveau de l'action — réservation, soumission ou routage — en raison de l'absence de points de terminaison appelables. Cela provoque une perte d'utilisateurs invisible, sans aucun signal d'analyse.

Agent IA intégré dans le shell : Extension de tampon terminal et de superposition
Shell open source avec agent IA intégré qui lit la sortie du terminal et tape des commandes via une superposition flottante. Prend en charge les modèles locaux et cloud.

Tessera : Espace de travail GUI open-source pour gérer plusieurs sessions Claude Code
Tessera est une interface graphique open source qui permet d'exécuter plusieurs sessions Claude Code côte à côte avec isolation des worktrees Git, suivi des tâches Kanban, diff en direct et inspection de l'activité des agents.

Analyse Codeflash : 118 bogues de performance détectés dans deux PR rédigés avec Claude Code
Codeflash a mesuré les performances de deux fonctionnalités majeures développées avec Claude Code et a constaté que 118 fonctions fonctionnaient jusqu'à 446 fois plus lentement que nécessaire. L'analyse a révélé des schémas d'algorithmes inefficaces, de calculs redondants, d'absence de mise en cache et de structures de données sous-optimales.