Afinando o llama3.2 3B para coaching de saúde personalizado usando dados do Apple Watch e MLX

Um desenvolvedor criou um LLM personalizado de coach de saúde ajustando o llama3.2 3B em um Mac usando dados do Apple Health e Whoop. Todo o processo de ajuste fino levou aproximadamente 15 minutos usando MLX.
Pipeline técnico
A implementação segue este fluxo de trabalho:
- Dados do Apple Health e Whoop armazenados em banco de dados SQLite local
- Camada SQL RAG converte consultas em linguagem natural para SQL
- API Claude usada uma vez para gerar ~270 exemplos de treinamento padrão-ouro (pares anonimizados de pergunta/SQL/resultado, nenhum dado pessoal de saúde enviado)
- Ajuste fino LoRA no llama3.2 3B via MLX
- Modelo fundido servido localmente em 127.0.0.1:8080
Antes vs. depois do ajuste fino
A fonte fornece exemplos concretos da melhoria:
Antes do ajuste fino: "Seu HRV é uma medida importante da função do sistema nervoso autônomo..." [500 palavras de conselho genérico]
Depois do ajuste fino: "Seu HRV teve média de 68ms esta semana, queda de 12% em relação aos 77ms da semana passada. Coincide com 3 noites com menos de 7 horas de sono. Considere reduzir a intensidade do treino por 48 horas."
Pegada de memória e hardware
- Modelo (4-bit): ~2 GB
- Adaptador LoRA: ~50 MB
- Memória de treinamento: ~4-5 GB total
- Executa em Mac da série M, sem necessidade de GPU
O desenvolvedor menciona incluir detalhes técnicos sobre guardrails contra alucinações SQL, enriquecimento de contexto entre métricas e o pipeline de treinamento em sua documentação completa. Eles também se oferecem para responder perguntas sobre a configuração MLX ou implementação da camada RAG.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Claude AI Adota Terminologia Personalizada de Especificações de 300 Páginas Sem Solicitação
Um desenvolvedor carregou mais de 300 páginas de especificações formais no Claude IA como conhecimento do projeto, incluindo 88.000 palavras em 20 artigos, 35 falsificadores, um glossário, guia de campo, conjunto de testes e kit de ferramentas de compressão. O Claude começou a usar o vocabulário personalizado operacionalmente para descrever seus próprios processos sem ser solicitado.

Transforme seu Briefing do OpenClaw em um Feed de Podcast para Apple Podcasts
Um usuário do Reddit compartilha um fluxo de trabalho simples para converter a saída do briefing matinal do OpenClaw em um feed de podcast: converter o texto em áudio (TTS), hospedar o MP3, anexar ao XML do RSS e assinar no Apple Podcasts.

Lições práticas da automação de prospecção no LinkedIn com OpenClaw
Um desenvolvedor compartilha lições aprendidas com dificuldade após três semanas de automação de prospecção no LinkedIn com o OpenClaw, abordando a detecção de automação do LinkedIn, períodos de aquecimento de contas, pontuação de ICP com sinais de intenção, nuances de limitação de taxa e design de fluxo de conversa.

Como Usar o Claude Code de Forma Eficaz: A Experiência de um Desenvolvedor na Criação de um Aplicativo SaaS Completo
Um desenvolvedor com experiência em SaaS desde 2021 construiu um aplicativo completo de repetição espaçada chamado codefluent.app usando Claude Code, enfatizando que o sucesso depende de escrever especificações técnicas detalhadas em vez de prompts vagos. O projeto utilizou SvelteKit, PostgreSQL com Drizzle ORM, Better Auth, OpenRouter, Stripe, CodeMirror 6, Tailwind v4 e Railway.