A Pesquisa Automática de Karpathy Portada para o Motor Neural da Apple para Melhor Rendimento por Watt

✍️ OpenClawRadar📅 Publicado: April 17, 2026🔗 Source
A Pesquisa Automática de Karpathy Portada para o Motor Neural da Apple para Melhor Rendimento por Watt
Ad

Um novo projeto protótipo combina o autoresearch de Andrej Karpathy com o desempenho do Apple Neural Engine (ANE) engenharia reversa, disponível em github.com/fiale-plus/autoresearch-ane. O principal atrativo é alcançar melhor throughput por watt em comparação com APIs oficiais.

Detalhes do Projeto

O projeto foi descrito como "colando os conceitos juntos" e atualmente é um protótipo que precisa de testes mais longos. O autor credita Claude pela implementação e reconhece miolini pela ideia original da porta MacOS.

Ad

Referências Técnicas

O projeto representa uma abordagem experimental para otimização de utilização de hardware, com a expectativa de que o desempenho melhore conforme o projeto ANE subjacente amadurece. Isso é particularmente relevante para desenvolvedores trabalhando com hardware Apple silicon que desejam maximizar a eficiência de inferência local.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Claude Code carrega esquemas de ferramentas sob demanda via ToolSearch para economizar tokens
Tools

Claude Code carrega esquemas de ferramentas sob demanda via ToolSearch para economizar tokens

O Claude Code adia o carregamento de esquemas de ferramentas, enviando apenas os nomes das ferramentas de antemão e exigindo uma chamada ToolSearch para buscar os esquemas antes do uso. Essa arquitetura reduz significativamente o consumo de tokens.

OpenClawRadar
O Unsloth Studio permite uma velocidade de treinamento 2x maior com redução de 70% no uso de VRAM para ajuste fino de IA local.
Tools

O Unsloth Studio permite uma velocidade de treinamento 2x maior com redução de 70% no uso de VRAM para ajuste fino de IA local.

O Unsloth Studio fornece ferramentas para treinar e ajustar modelos de linguagem em hardware local com treinamento 2x mais rápido e redução de 70% na VRAM. Ele suporta a exportação de modelos para o formato GGUF para uso com o Ollama e permite fluxos de trabalho completos de codificação com IA local em hardware de 24GB como a RTX 4090.

OpenClawRadar
Agente Claw Code: Reimplementação em Python da Arquitetura Claude Code para Modelos Locais
Tools

Agente Claw Code: Reimplementação em Python da Arquitetura Claude Code para Modelos Locais

Claw Code Agent é uma reimplementação em Python da arquitetura do agente Claude Code que roda com modelos open-source locais através de backends compatíveis com OpenAI como vLLM e Ollama, apresentando chamada de ferramentas, comandos de barra e permissões hierárquicas.

OpenClawRadar
GSD-Lite: Uma Máquina de Estado para Código Claude que Impõe TDD e Previne a Omissão de Testes
Tools

GSD-Lite: Uma Máquina de Estado para Código Claude que Impõe TDD e Previne a Omissão de Testes

GSD-Lite é um servidor MCP de código aberto que adiciona uma máquina de fluxo de trabalho de 12 estados ao Claude Code, impondo desenvolvimento orientado a testes com prompts específicos anti-racionalização e contextos de agentes separados para execução, revisão e depuração.

OpenClawRadar