Construindo um Assistente de Voz com IA Local usando SwiftUI e CSM-1B no Apple Silicon

Um desenvolvedor compartilhou seu projeto paralelo mobiGlas, um aplicativo SwiftUI que transforma o assistente de IA OpenClaw em um companheiro de voz mãos-livres. O app é executado inteiramente no Apple Silicon com conversão de fala em texto local, LLM local e clonagem de voz local usando CSM-1B — sem dependências em nuvem.
Detalhes Principais
- Ativação: Diga "Hey Skippy" nos AirPods para iniciar uma conversa.
- Voz: Usa o modelo de clonagem de voz CSM-1B executado localmente em um M2 Ultra. Gera ~15 segundos de áudio em cerca de 7 segundos.
- Tecnologia:
- OpenClaw — framework de assistente de IA executado no Mac
- mobiGlas — aplicativo SwiftUI com conversão de fala em texto e texto em fala em tempo real
- CSM-1B — modelo local de clonagem de voz
- AirPods — entrada/saída de áudio mãos-livres
- Status: v0.1 (descrito como "instável mas funcional"). A sensação de andar por aí conversando com a IA é relatada como "genuinamente surreal."
- Exemplo de voz: O desenvolvedor clonou a voz de R.C. Bray (narrador de Expeditionary Force) como o assistente "Skippy."
Próximos Passos
O desenvolvedor planeja refinar a experiência para usos diários como resumos de notícias, lembretes e discussão de ideias em voz alta.
Se você está experimentando com voz AI local no Apple Silicon, o desenvolvedor está aberto a trocar ideias.
📖 Leia a fonte completa: r/openclaw
👀 See Also

Padrão de Handoffs em Fluxos de Trabalho do Claude: Divisão em Dois Arquivos vs. Resumo em Um Documento
Sessões longas no Claude sofrem com degradação de contexto. Handoffs comprimem o que importa e recomeçam. Duas abordagens: skill de handoff de Matt Pocock vs divisão em dois arquivos com narrativa persistente e prompt efêmero.

Signet: Camada de Memória de Código Aberto para Agentes de IA de Programação Atinge 80% de F1 no LoCoMo
Signet é um sistema de memória de código aberto para agentes de IA de codificação que alcança 80% de F1 no benchmark LoCoMo, em comparação com 41% do RAG padrão. Ele extrai memórias após cada sessão e injeta contexto relevante antes dos prompts, executando localmente com SQLite.

Pneuma: Um Ambiente de Desktop Gerado por IA Onde o Software Se Materializa a Partir de Descrições
Pneuma é um ambiente de computação desktop onde você descreve o que deseja—um monitor de CPU, jogo, aplicativo de notas ou visualizador de dados—e um programa funcional se materializa em segundos. O sistema gera módulos autônomos em Rust, os compila para WebAssembly e os executa em instâncias sandboxed do Wasmtime com renderização GPU via wgpu.

O compilador SMELT reduz o uso de tokens do espaço de trabalho OpenClaw em até 95%.
O SMELT compila arquivos markdown do workspace do OpenClaw em um formato de execução mais denso, enviando apenas conteúdo relevante para modelos de IA. Os benchmarks mostram reduções de tokens de 76,1% a 95,5% em consultas, evitando o reprocessamento de arquivos estáticos como USER.md e SOUR.md em cada mensagem.