Construction d'un système multi-agent contrôlé par la voix sur Claude Code

✍️ OpenClawRadar📅 Publié: May 25, 2026🔗 Source
Construction d'un système multi-agent contrôlé par la voix sur Claude Code
Ad

Un développeur sur r/ClaudeAI a réalisé un projet de week-end qui ajoute le contrôle vocal à Claude Code sur macOS, avec un mot de réveil, une boucle vocale WebRTC et un système d'orchestration multi-agents. Ce qui a commencé comme un bidouillage de confort s'est transformé en un système où un agent principal décompose les tâches, recrute des sous-agents et les exécute en parallèle avec des passes QA auto-déclenchées.

Comment ça marche

  • Mot de réveil : "Yabby" déclenche la boucle vocale. Le développeur a choisi un mot de réveil personnalisé pour éviter les conflits avec Siri ou d'autres assistants.
  • Boucle vocale : WebRTC gère le streaming audio en temps réel. Le système utilise l'API Realtime d'Anthropic pour la reconnaissance et la synthèse vocales ; la latence cible est inférieure à 300 ms, mais l'API provoque parfois des retards.
  • Agent principal : Reçoit la demande vocale, effectue une phase de découverte, crée un plan de projet et recrute une petite équipe (manager + 2-3 sous-agents) pour exécuter les étapes.
  • Exécution parallèle : Les sous-agents s'exécutent en parallèle lorsque c'est possible, sinon séquentiellement. Chaque agent dispose de sa propre session CLI Claude Code avec un thread séparé — les conversations ne se mélangent pas.
  • Auto-QA : Lorsqu'un sous-agent termine, une passe de relecture est déclenchée avec un débounce de 5 secondes pour éviter les accumulations. Lors des tests, un agent a détecté un bug écrit par un autre agent — un comportement émergent que le développeur n'avait pas prévu.
  • Fenêtre d'approbation du plan : Avant qu'un agent n'exécute quoi que ce soit, une fenêtre contextuelle permet à l'utilisateur de vérifier le plan. Cela empêche le système d'exécuter des actions non vérifiées.
Ad

Points douloureux

  • Vérification du locuteur : Utilise la similarité cosinus sur les embeddings du locuteur. Le seuil est difficile à régler — trop strict, il rejette l'utilisateur lorsqu'il est enrhumé ; trop laxiste, il permet à n'importe qui dans la pièce de déclencher des commandes.
  • Problèmes de locale : Le français était la locale par défaut car le code a été écrit ainsi. Le développeur est en train de corriger cela.
  • Cycle de vie des tâches en arrière-plan : Lorsque le processus CLI parent de Claude Code se termine, les tâches en arrière-plan meurent silencieusement. Le développeur a écrit un watcher PID au niveau OS avec un script shell de comptabilité pour suivre les serveurs longue durée qui ont planté.
  • Sur-planification : L'agent principal produit parfois un plan de projet en quatre phases pour des demandes triviales comme renommer un fichier.

Questions ouvertes

Le développeur cherche encore comment réduire la verbosité de la phase QA, s'il doit laisser les sous-agents recruter leurs propres sous-agents (délégation récursive) et comment maintenir la latence vocale sous 300 ms lorsque l'API Realtime devient capricieuse. Il se demande également comment le mode vocal officiel d'Anthropic (déployé pour 5 % des utilisateurs) gérera la coordination multi-agents.

📖 Lisez la source complète : r/ClaudeAI

Ad

👀 See Also

llm-idle-timeout se déclenche à 2 minutes sur N100/WSL2 malgré le paramètre timeoutSeconds
Tools

llm-idle-timeout se déclenche à 2 minutes sur N100/WSL2 malgré le paramètre timeoutSeconds

Un utilisateur rapporte que le watchdog d'inactivité dans OpenClaw se déclenche après 2 minutes sur du matériel N100/WSL2, ignorant le paramètre timeoutSeconds=300, en raison d'un démarrage lent de la passerelle (45+ secondes) et de l'absence d'un noOutputTimeoutMs configurable.

OpenClawRadar
Claude Skill open-source structure les connaissances sur la croissance des SaaS B2B pour un raisonnement IA cohérent
Tools

Claude Skill open-source structure les connaissances sur la croissance des SaaS B2B pour un raisonnement IA cohérent

Un développeur a créé une compétence Claude open-source qui organise les leçons de partenariats à 90 millions de dollars de revenus annuels récurrents, 1 800 entretiens utilisateurs et 5 études de cas SaaS en connaissances structurées pour que Claude puisse s'y référer, améliorant la qualité des réponses pour des flux de travail complexes comme la validation du PMF et la planification GTM.

OpenClawRadar
Système de mémoire persistante sans code pour Claude utilisant Notion et MCP
Tools

Système de mémoire persistante sans code pour Claude utilisant Notion et MCP

Un radiologue a construit un 'Hub Cognitif' dans Notion que Claude lit et écrit via MCP, créant une base de connaissances structurée avec une table de routage pour charger uniquement les informations pertinentes par conversation. Le système a atteint plus de 70 pages après un mois d'utilisation quotidienne.

OpenClawRadar
Recherche web hors ligne : Une alternative locale à Google Search pour les agents IA
Tools

Recherche web hors ligne : Une alternative locale à Google Search pour les agents IA

Un développeur a créé offline-web-search pour remédier aux faibles capacités de recherche hors ligne des agents d'IA, en créant un remplacement direct qui imite les outils web de Claude avec un classement BM25, une indexation SQLite FTS5, et une prise en charge des archives ZIM et des robots d'indexation personnalisés.

OpenClawRadar