Construction d'un système multi-agent contrôlé par la voix sur Claude Code

✍️ OpenClawRadar📅 Publié: May 25, 2026🔗 Source
Construction d'un système multi-agent contrôlé par la voix sur Claude Code
Ad

Un développeur sur r/ClaudeAI a réalisé un projet de week-end qui ajoute le contrôle vocal à Claude Code sur macOS, avec un mot de réveil, une boucle vocale WebRTC et un système d'orchestration multi-agents. Ce qui a commencé comme un bidouillage de confort s'est transformé en un système où un agent principal décompose les tâches, recrute des sous-agents et les exécute en parallèle avec des passes QA auto-déclenchées.

Comment ça marche

  • Mot de réveil : "Yabby" déclenche la boucle vocale. Le développeur a choisi un mot de réveil personnalisé pour éviter les conflits avec Siri ou d'autres assistants.
  • Boucle vocale : WebRTC gère le streaming audio en temps réel. Le système utilise l'API Realtime d'Anthropic pour la reconnaissance et la synthèse vocales ; la latence cible est inférieure à 300 ms, mais l'API provoque parfois des retards.
  • Agent principal : Reçoit la demande vocale, effectue une phase de découverte, crée un plan de projet et recrute une petite équipe (manager + 2-3 sous-agents) pour exécuter les étapes.
  • Exécution parallèle : Les sous-agents s'exécutent en parallèle lorsque c'est possible, sinon séquentiellement. Chaque agent dispose de sa propre session CLI Claude Code avec un thread séparé — les conversations ne se mélangent pas.
  • Auto-QA : Lorsqu'un sous-agent termine, une passe de relecture est déclenchée avec un débounce de 5 secondes pour éviter les accumulations. Lors des tests, un agent a détecté un bug écrit par un autre agent — un comportement émergent que le développeur n'avait pas prévu.
  • Fenêtre d'approbation du plan : Avant qu'un agent n'exécute quoi que ce soit, une fenêtre contextuelle permet à l'utilisateur de vérifier le plan. Cela empêche le système d'exécuter des actions non vérifiées.
Ad

Points douloureux

  • Vérification du locuteur : Utilise la similarité cosinus sur les embeddings du locuteur. Le seuil est difficile à régler — trop strict, il rejette l'utilisateur lorsqu'il est enrhumé ; trop laxiste, il permet à n'importe qui dans la pièce de déclencher des commandes.
  • Problèmes de locale : Le français était la locale par défaut car le code a été écrit ainsi. Le développeur est en train de corriger cela.
  • Cycle de vie des tâches en arrière-plan : Lorsque le processus CLI parent de Claude Code se termine, les tâches en arrière-plan meurent silencieusement. Le développeur a écrit un watcher PID au niveau OS avec un script shell de comptabilité pour suivre les serveurs longue durée qui ont planté.
  • Sur-planification : L'agent principal produit parfois un plan de projet en quatre phases pour des demandes triviales comme renommer un fichier.

Questions ouvertes

Le développeur cherche encore comment réduire la verbosité de la phase QA, s'il doit laisser les sous-agents recruter leurs propres sous-agents (délégation récursive) et comment maintenir la latence vocale sous 300 ms lorsque l'API Realtime devient capricieuse. Il se demande également comment le mode vocal officiel d'Anthropic (déployé pour 5 % des utilisateurs) gérera la coordination multi-agents.

📖 Lisez la source complète : r/ClaudeAI

Ad

👀 See Also

Relvy améliore la précision de l'analyse des causes racines de Claude de 12 points de pourcentage sur le benchmark OpenRCA.
Tools

Relvy améliore la précision de l'analyse des causes racines de Claude de 12 points de pourcentage sur le benchmark OpenRCA.

Relvy, un outil qui automatise les runbooks, a démontré une amélioration de 12 points de pourcentage de la précision de Claude sur le benchmark OpenRCA pour l'analyse des causes racines. Les résultats ont été partagés via un post Hacker News avec 11 points.

OpenClawRadar
Outil open-source pour des flux Reddit organisés par IA utilisant Cloudflare, Supabase et Vercel
Tools

Outil open-source pour des flux Reddit organisés par IA utilisant Cloudflare, Supabase et Vercel

Un développeur a open-sourcé un outil auto-hébergé qui filtre Reddit pour trouver des publications de qualité sur le développement assisté par IA, utilisant Cloudflare Workers pour les tâches cron et les proxys, Supabase pour le stockage, et Vercel pour le frontend. L'outil inclut un score d'engagement, des résumés LLM optionnels, et coûte 1-2$/mois pour le traitement IA.

OpenClawRadar
PocketTeam : Un pipeline de code Claude avec des agents de sécurité et d'apprentissage basés sur des hooks
Tools

PocketTeam : Un pipeline de code Claude avec des agents de sécurité et d'apprentissage basés sur des hooks

PocketTeam est un pipeline Claude Code qui implémente 9 couches de sécurité au niveau des appels d'outils pour bloquer les opérations dangereuses comme les écritures dans .env ou les commandes rm -rf. Le système inclut un agent Observateur qui analyse les tâches terminées et écrit des apprentissages structurés pour améliorer les performances futures des agents.

OpenClawRadar
L'extension Microsoft DebugMCP pour VS Code confère aux agents IA des capacités de débogage.
Tools

L'extension Microsoft DebugMCP pour VS Code confère aux agents IA des capacités de débogage.

Microsoft DebugMCP est une extension VS Code qui expose le débogueur complet de VS Code aux agents d'IA de codage via le Model Context Protocol (MCP), leur permettant de définir des points d'arrêt, d'exécuter le code pas à pas, d'inspecter des variables et d'évaluer des expressions.

OpenClawRadar