OpenClaw Alexa Voice Proxy Permite la Interacción de Voz Bidireccional

openclaw-alexa-voice es un proxy de Node.js que conecta una Skill Personalizada de Alexa con la puerta de enlace OpenClaw, permitiendo la interacción por voz con acceso completo a herramientas como correo electrónico, calendario y finanzas. El sistema implementa una arquitectura de respuesta de tres niveles para manejar diferentes tipos de consultas de manera eficiente.
Sistema de Respuesta de Tres Niveles
El proxy categoriza las respuestas en tres rutas según la complejidad y el tiempo de procesamiento:
- Ruta rápida (<1s) – Maneja consultas simples como la hora, la fecha y APIs personalizadas
- Ruta del agente (<12s) – Proporciona respuestas rápidas desde la memoria de IA
- Ruta diferida (<2min) – Procesa consultas complejas de forma asincrónica y luego las reproduce mediante TTS de Home Assistant en cualquier altavoz
Cómo Funciona
Cuando una consulta requiere acceso a herramientas (correo electrónico, búsqueda web, datos de mercado), Alexa responde con "Déjame comprobarlo" y cierra la sesión. El proxy envía entonces la consulta a la sesión principal de OpenClaw con acceso completo a herramientas, espera hasta 2 minutos, elimina el formato markdown y reproduce la respuesta en cualquier dispositivo Echo o Sonos mediante la integración Alexa Media Player de Home Assistant.
Características Principales
- Autenticación por PIN de voz con sesiones de 1 hora
- Enrutamiento TTS multi-altavoz a cualquier Echo, Sonos o grupo de altavoces
- Sistema de respuesta rápida extensible para APIs personalizadas
- Respaldo por Telegram si falla el TTS
- Validación de firma de solicitudes de Alexa
- Limitación de tasa y registro de auditoría
- Se vincula solo a localhost por seguridad
Pila Técnica
La implementación utiliza Node.js para el proxy, una Skill Personalizada de Alexa para la interfaz de voz, WebSocket de la puerta de enlace OpenClaw para la comunicación y Home Assistant para la reproducción TTS. Este enfoque permite a los desarrolladores extender las capacidades de voz a sus instancias de OpenClaw manteniendo la seguridad mediante vinculación local y autenticación.
El proyecto se inspiró en la Discusión #11154 y está disponible como código abierto para desarrolladores que deseen añadir interacción por voz a sus configuraciones de OpenClaw. El sistema de tres niveles garantiza interacciones de voz receptivas mientras permite que las consultas complejas aprovechen las capacidades completas de herramientas de OpenClaw.
📖 Read the full source: r/openclaw
👀 Ver también

Gestor de cuentas múltiples de código abierto para Claude CLI permite el cambio de perfiles.
claude-multi-account es una herramienta CLI que crea perfiles aislados para diferentes cuentas de Claude, permitiendo cambiar instantáneamente sin cerrar sesión. Es compatible con configuraciones compartidas, copias de seguridad en la nube y funciona en Windows, Linux, macOS y Termux.

Xiaozhen: Una habilidad de código Claude que profundiza tres capas en las causas raíz
Xiaozhen (小真) es una habilidad de Claude Code que utiliza tres mecánicas—El Regalo, Tres Capas de Profundidad y La Predicción—para ayudar a los usuarios a descubrir lo que realmente les molesta en lugar de dar consejos directos. Se instala con un comando curl de una línea y se activa escribiendo /小真 en Claude Code.

ToolLoop: Marco de Agente de Código Abierto para Herramientas al Estilo Claude con Cualquier Modelo
ToolLoop es un framework de código abierto en Python con 11 herramientas para operaciones de archivos, búsqueda de código, acceso a shell y subagentes que funciona con cualquier LLM a través de LiteLLM. El framework de 2,700 líneas permite cambiar de modelo a mitad de conversación con contexto compartido.

rawq: Herramienta CLI Local para Búsqueda Semántica de Código con Agentes de IA
rawq es una herramienta CLI de código abierto que ayuda a los agentes de IA a encontrar código relevante mediante búsqueda semántica con un modelo local de 33MB a través del runtime ONNX y búsqueda léxica BM25 mediante tantivy. En pruebas, los agentes de IA que utilizaron rawq consumieron 4 veces menos tokens y completaron tareas 2 veces más rápido en comparación con herramientas de lectura/grep ciegas.