Echo-TTS Portado a Apple Silicon con MLX para TTS Nativo con Clonación de Voz

✍️ OpenClawRadar📅 Publicado: 7 de marzo de 2026🔗 Source
Echo-TTS Portado a Apple Silicon con MLX para TTS Nativo con Clonación de Voz
Ad

Echo-TTS, un modelo de transformador de difusión (DiT) de 2.4B parámetros para texto a voz con clonación de voz, ha sido adaptado de CUDA para ejecutarse nativamente en silicio Apple de la serie M utilizando MLX. La adaptación permite que el modelo genere voz en un tono objetivo cuando se le proporciona texto y un breve clip de audio de alguien hablando.

Rendimiento y Puntos de Referencia

En un Mac mini M4 base de 16GB, el modelo genera un clon de voz corto de 5 segundos en aproximadamente 10 segundos. Clones de hasta 30 segundos tardan aproximadamente 60 segundos en generarse.

Características Principales

  • Cuantización de 8 bits: Reduce el uso de memoria de aproximadamente 6 GB a unos 4 GB, se ejecuta más rápido con pérdida de calidad insignificante.
  • Generación por bloques: Permite transmisión en tiempo real y continuaciones de audio.

Detalles de Desarrollo

Esta fue una adaptación asistida por IA. Claude Opus 4.6 manejó la especificación y validación, GPT-5.3-Codex realizó la implementación, y el desarrollador dirigió el proyecto a través de OpenClaw.

El repositorio está disponible en github.com/mznoj/echo-tts-mlx.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Ver también

La Habilidad OpenClaw Conecta a los Agentes con la Interfaz de Usuario de Knods.io para la Creación de Flujos de Trabajo
Herramientas

La Habilidad OpenClaw Conecta a los Agentes con la Interfaz de Usuario de Knods.io para la Creación de Flujos de Trabajo

Un desarrollador ha creado una habilidad de OpenClaw que permite a los agentes comprender y crear flujos de trabajo dentro de la interfaz de usuario de Knods.io, lo que permite a los usuarios cambiar entre agentes específicos, como los específicos de marca, en lugar de depender del agente integrado de Knods.

OpenClawRadar
Freddy MCP Server: Dale a tu Agente OpenClaw Acceso de Lectura a Datos de Salud Personales
Herramientas

Freddy MCP Server: Dale a tu Agente OpenClaw Acceso de Lectura a Datos de Salud Personales

Freddy es un servidor personal de datos de salud que expone sueño, recuperación, carga de entrenamiento y más como un servidor MCP, permitiendo que los agentes OpenClaw razonen sobre datos reales del cuerpo.

OpenClawRadar
Benchmark: MLX vs Ollama ejecutando Qwen3-Coder-Next de 8 bits en MacBook Pro M5 Max
Herramientas

Benchmark: MLX vs Ollama ejecutando Qwen3-Coder-Next de 8 bits en MacBook Pro M5 Max

Un punto de referencia que compara los backends MLX y Ollama ejecutando Qwen3-Coder-Next con cuantización de 8 bits en un MacBook Pro M5 Max con 128 GB de RAM muestra que MLX alcanza aproximadamente 72 tokens por segundo, aproximadamente el doble del rendimiento de Ollama en diversas tareas de programación.

OpenClawRadar
Usando pre-commit para mejorar la calidad y seguridad del código generado por IA
Herramientas

Usando pre-commit para mejorar la calidad y seguridad del código generado por IA

Un desarrollador comparte su configuración de pre-commit para proyectos en Go y Java, utilizando herramientas como golangci-lint, govulncheck y checkov para detectar vulnerabilidades y problemas de calidad en código generado por IA antes del commit.

OpenClawRadar