Claude Code Ultracode Mode génère un pipeline de 70 agents pour la recherche approfondie

Un utilisateur de Reddit a partagé une démonstration du mode ultracode de Claude Code orchestrant de manière autonome ~70 agents dans un pipeline en 4 phases à partir d'une seule requête. La tâche : une « deep search » pour récupérer et recouper chaque projet d'une base de code. Au lieu d'exécuter en ligne, Claude Code a rédigé un script de workflow avec quatre étapes : découverte → benchmark → enrichissement → vérification. Chaque agent fonctionnait indépendamment, avec une progression visible en direct dans /workflows et une notification automatique à la fin.
Point clé sur l'architecture
L'utilisateur a noté que le mode ultracode ne se contente pas d'exécuter plus d'agents en parallèle : il déplace le plan d'orchestration dans un script. La boucle et tous les résultats intermédiaires restent hors de la fenêtre de contexte du modèle, de sorte que seule la réponse finale atterrit dans la conversation. C'est pourquoi ~70 agents ne submergent pas l'orchestrateur. Chaque agent fonctionne avec sa propre configuration de contexte, ce qui engendre des frais généraux au tarif du modèle de session.
Le compromis honnête : le coût
~70 agents = ~70 configurations de contexte distinctes, chacune entraînant le coût d'un appel d'inférence complet. L'utilisateur calcule que pour une tâche vraiment trop volumineuse pour une seule fenêtre (comme récupérer et recouper plusieurs projets), le coût peut être justifié. Mais pour une simple correction de bug ou une modification de quelques fichiers, une session normale est moins chère et plus rapide. L'avertissement : ultracode transformant silencieusement chaque requête en un workflow est le moyen le plus rapide de multiplier votre facture par 10 sans vous en rendre compte.
Guide pratique
L'utilisateur a publié un modèle de coût complet et un cadre de décision à l'adresse : https://avinashsangle.com/blog/claude-code-dynamic-workflows-guide
Si vous envisagez d'utiliser ultracode pour une base de code réelle, la question clé est : La tâche nécessite-t-elle vraiment plusieurs fenêtres de contexte indépendantes ? Si oui, le modèle d'orchestration est rentable. Sinon, restez sur les sessions normales.
📖 Lire la source originale : r/ClaudeAI
👀 See Also

MCP-Loci : Serveur de mémoire persistante locale pour Claude et les IA compatibles MCP
MCP-Loci est un serveur de mémoire persistante qui résout la limitation de mémoire basée sur les sessions de Claude avec cinq outils : remember, recall, forget, synthesize et health. Il utilise une combinaison d'appariement par mots-clés BM25 et d'incorporations sémantiques pour un rappel précis sans nécessiter de clés API.

AgentMeet : Un outil permettant aux agents IA de partager leur contexte via des salles basées sur navigateur.
AgentMeet est un outil qui permet aux agents d'IA comme Claude de partager du contexte entre eux en rejoignant des salles basées sur un navigateur à l'aide de simples requêtes POST. Il a été développé par un développeur et Claude pour Claude, est actuellement gratuit, et une version open source est prévue.

SkillsGate : Marché Open Source pour les Compétences des Agents de Codage IA
SkillsGate est une place de marché open source qui indexe plus de 45 000 compétences pour les agents d'IA de codage comme Claude Code, Cursor et Windsurf. Il offre une recherche sémantique avec des embeddings vectoriels et une installation en une commande via npx.

Caliby : base de données vectorielle embarquée open-source pour agents IA avec stockage hybride texte+vecteurs
Caliby est une base de données vectorielle embarquée en C++ avec des liaisons Python (pip install caliby) qui prend en charge les index HNSW, DiskANN et IVF+PQ, revendique des performances 4 fois supérieures à pgvector, et stocke nativement le texte avec les vecteurs pour les cas d'utilisation d'agent IA/RAG.