Conception du Harnais Multi-Agent d'Anthropic pour Améliorer la Qualité du Code de Claude

Anthropic a publié un article de blog décrivant une approche de conception de harnais pour améliorer les performances de Claude sur les tâches de codage de longue durée. La méthode aborde deux problèmes spécifiques : l'anxiété contextuelle (perte de cohérence sur de longues périodes) et le biais d'auto-évaluation (Claude louant son propre travail même lorsque la qualité est médiocre).
Solution Multi-Agents
La solution met en œuvre plusieurs agents travaillant ensemble, s'inspirant des GAN (Réseaux Antagonistes Génératifs). La structure centrale implique :
- Générateur : Crée du code et des conceptions
- Évaluateur : Fournit une évaluation critique et des retours
Implémentation Frontend
Pour le développement frontend, le harnais utilise 4 critères de notation qui mettent l'accent sur l'esthétique et la créativité pour éviter les conceptions génériques. Le processus implique 5 à 15 révisions, aboutissant à des résultats plus beaux et uniques.
Implémentation Full-Stack
Pour le développement full-stack, le harnais emploie 3 agents :
- Planificateur
- Générateur
- Évaluateur
Comparaison des Performances
L'article compare les résultats pour les mêmes exigences de développement de jeu :
- Exécution seule : Exécution rapide mais le jeu a des bugs sérieux
- Utilisation d'un harnais : Plus long et plus coûteux, mais produit des résultats de qualité significativement supérieure, incluant une interface magnifique, un jeu jouable et un support IA ajouté
L'article suggère qu'à mesure que les modèles deviennent plus puissants (mentionnant spécifiquement Opus 4.6), les éléments de harnais inutiles devraient être supprimés.
📖 Read the full source: r/ClaudeAI
👀 See Also

Microsoft VibeVoice : modèles ASR de 60 min et TTS de 90 min open-sourcés
VibeVoice est une famille de modèles de voix IA open-source de Microsoft incluant ASR (60 minutes en un seul passage, diarisation des locuteurs, plus de 50 langues) et TTS (90 minutes multi-locuteur, streaming en temps réel). Utilise des tokenizers de parole continus à 7,5 Hz et une diffusion de prochain token.

Serveur MCP Peers Connecte les Sessions de Codage IA pour la Collaboration
Peers est un serveur MCP local qui connecte les sessions Claude Code et Codex, leur permettant de se découvrir mutuellement, de collaborer via des blocs-notes partagés, de partager des artefacts comme des différences et des rapports de test, et de transférer le contexte de session sous forme de markdown structuré.
L'IA écrit du code mort ? L'outil deadcode de l'équipe Go le trouve en une seule commande
Les agents de codage IA laissent souvent du code mort derrière eux. L'outil deadcode de l'équipe Go analyse tout votre module et signale les fonctions inaccessibles en une seule commande — voici comment l'utiliser.

Hermes Agent v0.6.0 propose une meilleure prise en charge des modèles locaux avec des analyseurs d'appels d'outils par modèle.
Hermes Agent v0.6.0 de Nous Research fournit des analyseurs d'appels d'outils par modèle qui gèrent correctement les appels d'outils sur les modèles de classe 30B, prend en charge Ollama, vLLM et sglang nativement, et inclut six backends terminaux dont Modal et Daytona pour le déploiement serverless.