Echo-TTS Portado para Apple Silicon com MLX para TTS Nativo com Clonagem de Voz

O Echo-TTS, um modelo de transformador de difusão (DiT) de 2,4B parâmetros para texto em fala com clonagem de voz, foi adaptado do CUDA para rodar nativamente no silício da série M da Apple usando MLX. A adaptação permite que o modelo gere fala em uma voz alvo quando recebe texto e um pequeno clipe de áudio de alguém falando.
Desempenho e Benchmarks
Em um Mac mini M4 básico de 16GB, o modelo gera um clone de voz curto de 5 segundos em cerca de 10 segundos. Clones de até 30 segundos levam aproximadamente 60 segundos para gerar.
Principais Recursos
- Quantização de 8 bits: Reduz o uso de memória de aproximadamente 6 GB para cerca de 4 GB, roda mais rápido com perda de qualidade insignificante.
- Geração em blocos: Permite streaming e continuações de áudio.
Detalhes do Desenvolvimento
Esta foi uma adaptação assistida por IA. O Claude Opus 4.6 lidou com especificação e validação, o GPT-5.3-Codex realizou a implementação, e o desenvolvedor conduziu o projeto através do OpenClaw.
O repositório está disponível em github.com/mznoj/echo-tts-mlx.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Hypura: Agendador de inferência de LLM com consciência de camada de armazenamento para Apple Silicon
Hypura é um agendador de inferência baseado em Rust que posiciona tensores do modelo nas camadas GPU, RAM e NVMe para executar modelos que excedem a memória física em Macs Apple Silicon. Ele permite executar um Mixtral 8x7B de 31GB em um Mac Mini de 32GB a 2,2 tok/s e um Llama 70B de 40GB a 0,3 tok/s, onde o llama.cpp padrão trava.

Engenharia Reversa do Apple Neural Engine para Treinar Modelos MicroGPT
Um desenvolvedor engenhou reversamente as APIs privadas do Neural Engine da Apple para criar um pipeline de treinamento para um modelo MicroGPT de 110 milhões de parâmetros, alcançando eficiência energética de 6,6 TFLOPs/watt no hardware Mac M4.

Pesquisadores de Stanford Lançam OpenJarvis: Uma Estrutura Local-First para Agentes de IA em Dispositivos
Pesquisadores de Stanford lançaram o OpenJarvis, um framework local-first para construir agentes de IA pessoais no dispositivo com ferramentas, memória e capacidades de aprendizado. O projeto inclui links para repositório no GitHub e site para desenvolvedores explorarem.

blend-ai: Novo Serviço MCP do Blender para Claude Code
blend-ai é um novo serviço MCP do Blender que permite ao Claude Code gerar cenas 3D. Um usuário relatou que funcionou mais rápido e melhor que o blender-mcp, criando uma cena de lançamento de ônibus espacial a partir de imagens de referência em 5 minutos.