Construyendo un sistema multiagente controlado por voz sobre Claude Code

✍️ OpenClawRadar📅 Publicado: 25 de mayo de 2026🔗 Source
Construyendo un sistema multiagente controlado por voz sobre Claude Code
Ad

Un desarrollador en r/ClaudeAI creó un proyecto de fin de semana que añade control por voz a Claude Code en macOS, con palabra de activación, bucle de voz WebRTC y un sistema de orquestación multiagente. Lo que empezó como un truco de conveniencia se convirtió en un sistema donde un agente principal descompone tareas, recluta subagentes y los ejecuta en paralelo con pases de QA automáticos.

Cómo funciona

  • Palabra de activación: "Yabby" inicia el bucle de voz. El desarrollador eligió una palabra personalizada para evitar conflictos con Siri u otros asistentes.
  • Bucle de voz: WebRTC maneja la transmisión de audio en tiempo real. El sistema usa la API Realtime de Anthropic para conversión de voz a texto y texto a voz; la latencia objetivo es inferior a 300 ms, pero la API a veces causa retrasos.
  • Agente principal: Recibe la solicitud de voz, realiza una fase de descubrimiento, crea un plan de proyecto y recluta un pequeño equipo (gerente + 2-3 subagentes) para ejecutar los pasos.
  • Ejecución en paralelo: Los subagentes se ejecutan en paralelo cuando es posible, secuencialmente en caso contrario. Cada agente tiene su propia sesión CLI de Claude Code con un hilo separado: las conversaciones no se mezclan.
  • Auto-QA: Cuando un subagente termina, se activa un pase de revisión con un debounce de 5 segundos para evitar acumulaciones. Durante las pruebas, un agente detectó un error escrito por otro agente, un comportamiento emergente que el desarrollador no esperaba.
  • Modal de aprobación del plan: Antes de que cualquier agente ejecute, aparece un modal para que el usuario revise el plan. Esto evita que el sistema ejecute acciones no verificadas.
Ad

Puntos problemáticos

  • Verificación del hablante: Usa similitud de coseno en embeddings de voz. El umbral es difícil de ajustar: demasiado estricto rechaza al usuario si tiene resfriado; demasiado permisivo permite que cualquiera en la sala active comandos.
  • Problemas de configuración regional: El francés era la configuración regional predeterminada porque el código estaba escrito así. El desarrollador lo está solucionando poco a poco.
  • Ciclo de vida de tareas en segundo plano: Cuando el proceso CLI principal de Claude Code termina, las tareas en segundo plano mueren silenciosamente. El desarrollador escribió un vigilante de PID a nivel de SO con un script shell de contabilidad para rastrear qué servidores de larga duración han fallado.
  • Sobreplanificación: El agente principal a veces produce un plan de proyecto de cuatro fases para solicitudes triviales como renombrar un archivo.

Preguntas abiertas

El desarrollador aún está averiguando cómo reducir la verbosidad en la fase de QA, si dejar que los subagentes recluten sus propios subagentes (delegación recursiva) y cómo mantener la latencia de voz por debajo de 300 ms cuando la API Realtime se vuelve inestable. También le intriga cómo el modo de voz oficial de Anthropic (implementado para el 5% de los usuarios) manejará la coordinación multiagente.

📖 Lee la fuente completa: r/ClaudeAI

Ad

👀 Ver también

HostedShell: Una Solución de Implementación Basada en Web para Agentes OpenClaw
Herramientas

HostedShell: Una Solución de Implementación Basada en Web para Agentes OpenClaw

HostedShell es una versión alojada de OpenClaw que elimina la configuración local de la CLI, la gestión de dependencias y el emparejamiento manual al proporcionar una consola web con acceso directo al terminal y actualizaciones del sistema de archivos.

OpenClawRadar
Marco de Defensa en Capas para la Aplicación de Reglas de Código Claude
Herramientas

Marco de Defensa en Capas para la Aplicación de Reglas de Código Claude

Un profesional de operaciones de TI construyó un marco de defensa de 8 capas para hacer cumplir las reglas de Claude Code después de descubrir que tanto los prompts de CLAUDE.md como los hooks de bloqueo podían ser evitados. El enfoque adapta el modelo de queso suizo de la investigación de accidentes para prevenir soluciones alternativas.

OpenClawRadar
Herramienta de Respaldo de Base de Datos PostgreSQL Obtiene Soporte de Código Abierto de Anthropic
Herramientas

Herramienta de Respaldo de Base de Datos PostgreSQL Obtiene Soporte de Código Abierto de Anthropic

Anthropic ha reconocido la herramienta de copias de seguridad de bases de datos de código abierto Databasus a través de su programa Claude para Código Abierto, proporcionando a los mantenedores acceso gratuito a Claude Max. La herramienta es compatible con PostgreSQL, MySQL, MariaDB y MongoDB, e incluye copias de seguridad programadas, más de 70 destinos de almacenamiento y cifrado AES-256-GCM.

OpenClawRadar
Utilizando un servidor MCP para optimizar aplicaciones de React Native con Claude Code.
Herramientas

Utilizando un servidor MCP para optimizar aplicaciones de React Native con Claude Code.

Un servidor MCP transmite datos de ejecución en vivo desde una aplicación de React Native a Claude Code, identificando problemas de rendimiento como el thrashing en el almacén de Zustand y re-renderizados innecesarios.

OpenClawRadar