Engenharia Reversa do Apple Neural Engine para Treinar Modelos MicroGPT

✍️ OpenClawRadar📅 Publicado: March 1, 2026🔗 Source
Engenharia Reversa do Apple Neural Engine para Treinar Modelos MicroGPT
Ad

Acesso Direto ao Neural Engine da Apple

Um desenvolvedor contornou o framework CoreML da Apple para acessar diretamente o Apple Neural Engine (ANE) em um Mac mini M4, criando um pipeline de treinamento personalizado para modelos de linguagem pequenos. O projeto envolveu engenharia reversa das APIs privadas do ANE usando Claude, depois executando benchmarks e implementando treinamento sem a interface CoreML recomendada pela Apple.

Especificações Técnicas e Desempenho

O ANE no chip M4 fornece 38 TFLOPS de computação INT8 declarada, embora o desenvolvedor observe que na verdade é um processador FP16, tornando a computação efetiva metade desse valor. O pico de computação no ANE consome apenas 2,8W, resultando em eficiência de 6,6 TFLOPS/watt. Para comparação, a GPU Metal alcança aproximadamente 1 TFLOPS/watt, enquanto o H100 da NVIDIA chega a 1,4 TFLOPS/watt.

Implementação do Treinamento

O desenvolvedor criou um pipeline de treinamento personalizado que treinou com sucesso um modelo MicroGPT de 110 milhões de parâmetros no ANE. Embora um único chip não possa treinar praticamente modelos maiores, o desenvolvedor sugere que um cluster de dispositivos ANE poderia teoricamente treinar modelos maiores. Mesmo em um único dispositivo, o treinamento LoRA para modelos de 3B ou 7B parâmetros deve ser viável.

Ad

Por Que Treinar em NPUs?

A principal motivação é a eficiência energética. A eficiência de 6,6 TFLOPS/watt do ANE o torna significativamente mais eficiente em energia do que os métodos tradicionais de treinamento em GPU, o que é particularmente valioso para computação de borda e desenvolvimento consciente de energia.

Recursos Disponíveis

  • Documentação de Engenharia Reversa
  • Resultados de benchmarks
  • Implementação de treinamento (Trabalho em Andamento)
  • Repositório GitHub com código

O projeto demonstra que o Neural Engine da Apple, normalmente tratado como uma caixa preta, pode ser acessado diretamente para fluxos de trabalho personalizados de treinamento de IA, oferecendo aos desenvolvedores uma alternativa ao treinamento baseado em GPU com eficiência energética superior.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Chat Saver CG: Extensão de Navegador Criada com Claude Exporta Conversas de 12 Plataformas de IA
Tools

Chat Saver CG: Extensão de Navegador Criada com Claude Exporta Conversas de 12 Plataformas de IA

Um desenvolvedor criou o Chat Saver CG, uma extensão de navegador que exporta e transfere conversas entre Claude, ChatGPT, Gemini e outras 9 plataformas de IA, usando extensivamente o Claude para o desenvolvimento, incluindo decisões de arquitetura, depuração de problemas de análise DOM e escrita da lógica do adaptador.

OpenClawRadar
🦀
Tools

Lathoa: Um aplicativo de matemática para crianças onde a IA deve errar

Lathoa é um app de matemática para crianças de 10 a 14 anos em que um robô chamado Errol resolve problemas passo a passo, com um passo intencionalmente errado. A parte difícil não foi fazer a IA ser inteligente — foi fazê-la errar de propósito.

OpenClawRadar
ClaudeMeter: Aplicativo de Menu Bar do macOS de Código Aberto para Monitoramento em Tempo Real do Uso do Claude
Tools

ClaudeMeter: Aplicativo de Menu Bar do macOS de Código Aberto para Monitoramento em Tempo Real do Uso do Claude

ClaudeMeter é um aplicativo gratuito e de código aberto para a barra de menu do macOS, destinado a assinantes do Claude Max, que exibe porcentagens de uso da sessão e semanal, temporizadores de reinício e indicadores de ritmo, sem interromper o fluxo de trabalho. Todo o aplicativo foi construído usando Claude (Claude Code/Opus) para o código Swift, backend Supabase e Edge Functions.

OpenClawRadar
Stagent: Camada de operações de código aberto para o Claude Agent SDK com governança local e orquestração de fluxos de trabalho
Tools

Stagent: Camada de operações de código aberto para o Claude Agent SDK com governança local e orquestração de fluxos de trabalho

Stagent é um espaço de trabalho de coordenação local-first e de código aberto construído sobre o Claude Agent SDK e a API Claude que fornece orquestração de fluxos de trabalho, guardrails de orçamento e governança com intervenção humana para agentes de IA. Inclui 15 superfícies de produto, 6 padrões de fluxo de trabalho, 52+ perfis de agentes reutilizáveis e roda inteiramente localmente com SQLite.

OpenClawRadar