35 jours de Claude Code : pourquoi 3 agents parallèles sont le vrai plafond

✍️ OpenClawRadar📅 Publié: June 28, 2026🔗 Source
35 jours de Claude Code : pourquoi 3 agents parallèles sont le vrai plafond
Ad

Après 35 jours et plus de 1 800 tours d'utilisation de Claude Code, un développeur sur r/ClaudeAI a isolé la raison pour laquelle le travail parallèle avec des agents atteint un plafond dur autour de trois threads simultanés. La cause première n'est pas les limites de contexte, la qualité des prompts ou la décomposition des tâches — c'est le coût humain de la fusion de travaux divergents.

Le modèle : N ≈ 1 / (fraction du temps d'attente)

L'auteur a découvert que le nombre maximal durable d'agents parallèles (N) est approximativement l'inverse de la fraction de temps que chaque agent passe à attendre une intervention humaine. Si un agent est inactif un tiers du temps en attendant des décisions, des révisions ou des directives, le plafond pratique est d'environ 3 agents. Cela correspond à l'expérience observée : un agent est facile, deux est génial, trois est la limite, et au-delà, vous cessez de travailler en parallèle pour gérer une file d'attente de versions confuses de vous-même.

Ad

Le vrai frein : l'étape de fusion

La partie la plus chronophage n'est pas le lancement des agents, mais la réconciliation de leurs sorties. L'auteur appelle cela la fusion. L'agent A touche à l'authentification, l'agent B modifie un flux UI, l'agent C refactorise un utilitaire partagé. Quelqu'un doit ensuite tout rassembler : résoudre les chevauchements, relire les hypothèses, décider quelle version gagne, et garantir que la base de code ait une forme cohérente au lieu de trois presque compatibles. Cette étape de fusion consomme la majeure partie des frais généraux.

Les correctifs courants n'ont pas supprimé le plafond :

  • Tâches plus petites — ont aidé marginalement, mais ont augmenté le nombre de fusions.
  • Instructions plus explicites — n'ont fonctionné que lorsque le travail était vraiment séparable.
  • Meilleurs résumés — les résumés ne fusionnent pas le code ni ne résolvent les décisions divergentes.

Changement d'approche : les agents comme des branches coûteuses

L'auteur traite désormais les agents parallèles comme des branches coûteuses nécessitant une stratégie de fusion planifiée, et non comme des cerveaux supplémentaires gratuits. La fusion est le véritable problème à résoudre. Le fil de discussion complet aborde la façon dont d'autres développeurs gèrent la fusion — à la main, en utilisant un agent comme intégrateur, en imposant des limites de tâches plus strictes, ou par d'autres méthodes.

Si vous faites du travail multi-agent sérieux dans Claude Code, la fusion est probablement aussi votre goulot d'étranglement. L'article propose un cadre pour l'identifier et invite la communauté à proposer des solutions.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Gonflement des tokens dans les cadres d'agents : un ratio entrée-sortie de 500:1 est normal
Tips

Gonflement des tokens dans les cadres d'agents : un ratio entrée-sortie de 500:1 est normal

Un utilisateur d'un framework d'agents auto-hébergé rapporte environ 21k tokens d'entrée par message et un ratio entrée/sortie de 500:1 dû aux définitions d'outils, au prompt système et à la mémoire. La communauté confirme qu'un contexte de base de 15 à 25k tokens est courant pour les agents utilisant des outils.

OpenClawRadar
Comment prévenir la dégradation de CLAUDE.md : Traiter les règles comme du code
Tips

Comment prévenir la dégradation de CLAUDE.md : Traiter les règles comme du code

Après 18 mois d'utilisation réelle, un développeur partage quatre disciplines pour garder CLAUDE.md sous 100 lignes : l'utiliser comme un index, séparer les règles des sources, auditer à chaque PR, et supprimer plus que vous n'ajoutez.

OpenClawRadar
Correction de la limite maxTokens du modèle Ollama Cloud : le maximum est de 16K, pas la valeur de configuration
Tips

Correction de la limite maxTokens du modèle Ollama Cloud : le maximum est de 16K, pas la valeur de configuration

Ollama cloud limite la sortie à 16 384 jetons, peu importe la configuration maxTokens. Réglez sur 14 000 pour éviter les erreurs EOF. Restructurez les sorties longues ou dirigez les agents lourds vers un fournisseur direct.

OpenClawRadar
Des invites système courtes améliorent l'adhérence de Claude et réduisent le gaspillage de jetons
Tips

Des invites système courtes améliorent l'adhérence de Claude et réduisent le gaspillage de jetons

Un développeur a découvert qu'en remplaçant une instruction système de 3 847 mots par plusieurs petites instructions ciblées (total ~200 mots), les dérives d'oubli des instructions de Claude ont disparu.

OpenClawRadar