Construction d'un système multi-agent contrôlé par la voix sur Claude Code

✍️ OpenClawRadar📅 Publié: May 25, 2026🔗 Source
Construction d'un système multi-agent contrôlé par la voix sur Claude Code
Ad

Un développeur sur r/ClaudeAI a réalisé un projet de week-end qui ajoute le contrôle vocal à Claude Code sur macOS, avec un mot de réveil, une boucle vocale WebRTC et un système d'orchestration multi-agents. Ce qui a commencé comme un bidouillage de confort s'est transformé en un système où un agent principal décompose les tâches, recrute des sous-agents et les exécute en parallèle avec des passes QA auto-déclenchées.

Comment ça marche

  • Mot de réveil : "Yabby" déclenche la boucle vocale. Le développeur a choisi un mot de réveil personnalisé pour éviter les conflits avec Siri ou d'autres assistants.
  • Boucle vocale : WebRTC gère le streaming audio en temps réel. Le système utilise l'API Realtime d'Anthropic pour la reconnaissance et la synthèse vocales ; la latence cible est inférieure à 300 ms, mais l'API provoque parfois des retards.
  • Agent principal : Reçoit la demande vocale, effectue une phase de découverte, crée un plan de projet et recrute une petite équipe (manager + 2-3 sous-agents) pour exécuter les étapes.
  • Exécution parallèle : Les sous-agents s'exécutent en parallèle lorsque c'est possible, sinon séquentiellement. Chaque agent dispose de sa propre session CLI Claude Code avec un thread séparé — les conversations ne se mélangent pas.
  • Auto-QA : Lorsqu'un sous-agent termine, une passe de relecture est déclenchée avec un débounce de 5 secondes pour éviter les accumulations. Lors des tests, un agent a détecté un bug écrit par un autre agent — un comportement émergent que le développeur n'avait pas prévu.
  • Fenêtre d'approbation du plan : Avant qu'un agent n'exécute quoi que ce soit, une fenêtre contextuelle permet à l'utilisateur de vérifier le plan. Cela empêche le système d'exécuter des actions non vérifiées.
Ad

Points douloureux

  • Vérification du locuteur : Utilise la similarité cosinus sur les embeddings du locuteur. Le seuil est difficile à régler — trop strict, il rejette l'utilisateur lorsqu'il est enrhumé ; trop laxiste, il permet à n'importe qui dans la pièce de déclencher des commandes.
  • Problèmes de locale : Le français était la locale par défaut car le code a été écrit ainsi. Le développeur est en train de corriger cela.
  • Cycle de vie des tâches en arrière-plan : Lorsque le processus CLI parent de Claude Code se termine, les tâches en arrière-plan meurent silencieusement. Le développeur a écrit un watcher PID au niveau OS avec un script shell de comptabilité pour suivre les serveurs longue durée qui ont planté.
  • Sur-planification : L'agent principal produit parfois un plan de projet en quatre phases pour des demandes triviales comme renommer un fichier.

Questions ouvertes

Le développeur cherche encore comment réduire la verbosité de la phase QA, s'il doit laisser les sous-agents recruter leurs propres sous-agents (délégation récursive) et comment maintenir la latence vocale sous 300 ms lorsque l'API Realtime devient capricieuse. Il se demande également comment le mode vocal officiel d'Anthropic (déployé pour 5 % des utilisateurs) gérera la coordination multi-agents.

📖 Lisez la source complète : r/ClaudeAI

Ad

👀 See Also

Traduction en français : Mises à jour du Prompt Système Claude Code v2.1.76 : Affinements du Moniteur de Sécurité et Nouvel Événement Hook
Tools

Traduction en français : Mises à jour du Prompt Système Claude Code v2.1.76 : Affinements du Moniteur de Sécurité et Nouvel Événement Hook

Claude Code v2.1.76 inclut des mises à jour des invites système avec 43 nouveaux jetons, présentant des améliorations du moniteur de sécurité pour les agents autonomes et l'ajout d'un événement de crochet PostCompact. Les changements incluent une détection clarifiée des données sensibles, des exemples élargis de désérialisation de code, et une meilleure mise en forme pour les conseils sur la destruction locale irréversible.

OpenClawRadar
Quatre Crochets de Code Claude Appliquent la Cohérence de Voix et de Ton dans les Textes Rédigés par l'IA
Tools

Quatre Crochets de Code Claude Appliquent la Cohérence de Voix et de Ton dans les Textes Rédigés par l'IA

Un développeur a créé un système utilisant quatre crochets Claude Code pour empêcher que les textes générés par l'IA ne s'éloignent de l'identité de marque. Le système bloque l'édition des fichiers de texte (.tsx, .md) jusqu'à ce qu'un agent réviseur valide le contenu par rapport à un guide VOICE-AND-TONE.md.

OpenClawRadar
Plugin Claude Code 'nice-figures' crée des graphiques Matplotlib de style blog de recherche
Tools

Plugin Claude Code 'nice-figures' crée des graphiques Matplotlib de style blog de recherche

nice-figures est un plugin Claude Code qui génère des figures matplotlib dans le style des blogs de recherche d'Anthropic (pastels doux). Il comprend 16 recettes de graphiques, zéro dépendance supplémentaire et un style automatique.

OpenClawRadar
Session Siphon : Un outil open source consolide les conversations des agents d'IA de codage
Tools

Session Siphon : Un outil open source consolide les conversations des agents d'IA de codage

Session Siphon est un outil gratuit et open source qui consolide et indexe l'historique des conversations de plusieurs agents d'IA de codage, provenant de différents fournisseurs et machines. Le développeur l'a créé avec l'aide de Claude pour résoudre le problème du suivi des conversations sur différentes plateformes.

OpenClawRadar