Echo-TTS Portado a Apple Silicon con MLX para TTS Nativo con Clonación de Voz

Echo-TTS, un modelo de transformador de difusión (DiT) de 2.4B parámetros para texto a voz con clonación de voz, ha sido adaptado de CUDA para ejecutarse nativamente en silicio Apple de la serie M utilizando MLX. La adaptación permite que el modelo genere voz en un tono objetivo cuando se le proporciona texto y un breve clip de audio de alguien hablando.
Rendimiento y Puntos de Referencia
En un Mac mini M4 base de 16GB, el modelo genera un clon de voz corto de 5 segundos en aproximadamente 10 segundos. Clones de hasta 30 segundos tardan aproximadamente 60 segundos en generarse.
Características Principales
- Cuantización de 8 bits: Reduce el uso de memoria de aproximadamente 6 GB a unos 4 GB, se ejecuta más rápido con pérdida de calidad insignificante.
- Generación por bloques: Permite transmisión en tiempo real y continuaciones de audio.
Detalles de Desarrollo
Esta fue una adaptación asistida por IA. Claude Opus 4.6 manejó la especificación y validación, GPT-5.3-Codex realizó la implementación, y el desarrollador dirigió el proyecto a través de OpenClaw.
El repositorio está disponible en github.com/mznoj/echo-tts-mlx.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

La Habilidad OpenClaw Conecta a los Agentes con la Interfaz de Usuario de Knods.io para la Creación de Flujos de Trabajo
Un desarrollador ha creado una habilidad de OpenClaw que permite a los agentes comprender y crear flujos de trabajo dentro de la interfaz de usuario de Knods.io, lo que permite a los usuarios cambiar entre agentes específicos, como los específicos de marca, en lugar de depender del agente integrado de Knods.

Freddy MCP Server: Dale a tu Agente OpenClaw Acceso de Lectura a Datos de Salud Personales
Freddy es un servidor personal de datos de salud que expone sueño, recuperación, carga de entrenamiento y más como un servidor MCP, permitiendo que los agentes OpenClaw razonen sobre datos reales del cuerpo.

Benchmark: MLX vs Ollama ejecutando Qwen3-Coder-Next de 8 bits en MacBook Pro M5 Max
Un punto de referencia que compara los backends MLX y Ollama ejecutando Qwen3-Coder-Next con cuantización de 8 bits en un MacBook Pro M5 Max con 128 GB de RAM muestra que MLX alcanza aproximadamente 72 tokens por segundo, aproximadamente el doble del rendimiento de Ollama en diversas tareas de programación.

Usando pre-commit para mejorar la calidad y seguridad del código generado por IA
Un desarrollador comparte su configuración de pre-commit para proyectos en Go y Java, utilizando herramientas como golangci-lint, govulncheck y checkov para detectar vulnerabilidades y problemas de calidad en código generado por IA antes del commit.