ClawVibe: Un asistente de voz manos libres para iOS para agentes de IA con STT/TTS en el dispositivo

ClawVibe es un asistente de voz nativo de iOS que te permite hablar con tu agente de IA completamente manos libres, diseñado para usar mientras conduces. El desarrollador lo creó tras enfrentarse al problema de un trayecto de 45 minutos donde las soluciones con el teléfono en la mano no eran seguras y las interfaces web requerían toques. Tras dos meses de trabajo, la aplicación está ahora en beta de TestFlight y será gratuita en la App Store.
Decisiones técnicas clave
La decisión arquitectónica principal: procesar todo el audio en el dispositivo. La versión inicial transmitía el audio de voz a un servidor para su transcripción, pero se encontró con picos de latencia y pérdida de paquetes en redes móviles. La solución fue manejar el reconocimiento de voz y la conversión de texto a voz en el teléfono, enviando solo el texto transcrito a través de la red. Esto elimina los problemas de conectividad; funciona incluso en áreas con poca cobertura.
El procesamiento en el dispositivo presentó un desafío técnico: la mayoría de los modelos de ML usan el framework Metal de Apple (aceleración GPU), que Apple no permite ejecutar en segundo plano. Por lo tanto, la aplicación recurre a CoreML estándar sin aceleración GPU para mantener activos la detección y el procesamiento de voz mientras la pantalla está apagada, una concesión necesaria para el uso manos libres.
El ruido de fondo (indicaciones del GPS, conversaciones, radio) fue otro punto crítico. La solución es la biometría de voz: la aplicación aprende tu perfil de voz y solo envía el habla reconocida a la IA. Los anuncios del GPS y otros ruidos se ignoran.
Características
- Reconocimiento de voz en el dispositivo: Transcrito localmente; no se envía audio a Apple ni a Google. Solo el texto va a tu backend de IA.
- TTS en el dispositivo: Múltiples opciones de voz, salida a través del teléfono o los altavoces de CarPlay.
- Detección de voz siempre activa: Sin necesidad de pulsar un botón ni palabra de activación; sabe cuándo estás hablando.
- Integración con CarPlay: Totalmente manos libres en el coche, la razón original para desarrollarlo.
- Reconocimiento de voz principal: Solo tu voz registrada activa la IA; los sonidos de fondo se filtran.
- Contexto GPS: Se envía la ubicación con cada mensaje para respuestas conscientes de la ubicación.
Backend y disponibilidad
Necesitas tu propio backend de IA para conectar ClawVibe. Soporta varias configuraciones, con más integraciones en desarrollo. Si ya ejecutas una instancia de OpenClaw, estás listo. Si no, puedes probar la aplicación con un modelo local en el dispositivo.
La aplicación está actualmente en beta de TestFlight. Una versión gratuita en la App Store proporcionará la experiencia completa de voz principal. Un nivel Premium (que llegará más tarde) añadirá más voces, múltiples perfiles de voz, interfaz de CarPlay ampliada, soporte para Apple Watch y más.
Para quién es
Desarrolladores que alojan sus propios agentes de IA y desean una interfaz de voz manos libres centrada en la privacidad para conducir u otras situaciones con las manos ocupadas.
📖 Lee la fuente completa: r/openclaw
👀 Ver también

Claude IDE Bridge: Herramienta MCP para Acceso Remoto al Editor
Claude IDE Bridge es una herramienta de código abierto que proporciona a Claude AI acceso de control remoto a editores de código a través de MCP (Protocolo de Contexto del Modelo). Expone conocimientos del editor como información de tipos en vivo y estado del depurador como herramientas invocables.

Maggy: Una plataforma de ingeniería autónoma en Claude Code con memoria entre sesiones y aprendizaje en equipo P2P
Maggy se sitúa en el Nivel 4 del espectro de herramientas de codificación de IA: orquestación multimodelo, memoria entre sesiones, inteligencia de procesos a partir de CI/revisiones y aprendizaje entre pares del equipo. Los benchmarks muestran una reducción del 83 % en el uso de Claude, mientras detecta 7 problemas de seguridad que el Claude Code de un solo pipeline pasó por alto.

Herramienta Local de Crítico de Imágenes con IA Utiliza Modelos de Visión Ollama para Retroalimentación
Un desarrollador ha creado una aplicación de escritorio gratuita que analiza imágenes generadas por IA localmente utilizando modelos de visión de Ollama. La herramienta proporciona informes de retroalimentación estructurados que incluyen sugerencias de mejora y actualizaciones de prompts.

Arquitectura de Prompt de Claude Code Ingeniería Inversa para Modelos Locales
Una reimplementación de sala limpia de la arquitectura de 26 prompts de Claude Code ya está disponible en GitHub, ofreciendo prompts del sistema, prompts de herramientas, reglas de seguridad, compresión de memoria y patrones de verificación para construir agentes de codificación en modelos locales como Ollama, llama.cpp o vLLM.