Testando δ-Mem no Apple Silicon: Implementação MLX e Benchmarks

✍️ OpenClawRadar📅 Publicado: May 16, 2026🔗 Source
Testando δ-Mem no Apple Silicon: Implementação MLX e Benchmarks
Ad

Um usuário do Reddit implementou o artigo de pesquisa δ-mem (arXiv 2605.12357) para Apple Silicon usando mlx e integração OpenClaw. O artigo melhora a direção da atenção do modelo sem contexto ou LoRA, relatando respostas 20% melhores em seus testes. A implementação usou Qwen3-4B-Instruct via mlx e adaptadores personalizados.

Resultados dos Benchmarks (testes mlx normalizados, Qwen3-4B-Instruct em MacMini 64GB):

  • Estilo sintético do artigo: Plain 0,5129, δ-mem 0,5129 (1,00x)
  • LoCoMo-10 mini: Plain 0,0500, δ-mem 0,1833 (3,67x)
  • Replay OpenClaw: Plain 0,5701, δ-mem 0,6667 (1,17x)

Custos de latência (vs plain):

  • Sintético: 1,013x
  • LoCoMo-10 mini: 1,33x query / 1,50x total
  • Replay OpenClaw: 1,30x

Links importantes:

Conclusões:

Ad
  • As sondas sintéticas ficaram planas (1,00x), mas o LoCoMo-mini mostrou fortes ganhos relativos (3,67x).
  • O replay estilo OpenClaw mostrou uma melhoria praticamente significativa (6/8 → 7/8 sondas aprovadas, 1,17x).
  • O usuário observa que o Apple Silicon não pode executar CUDA eficientemente, então os resultados são inferiores aos benchmarks do artigo. Os benchmarks do artigo (Qwen3-4B-Instruct) mostraram média de 1,10x vs backbone congelado, MemoryAgentBench 1,31x, LoCoMo 1,20x.
  • O usuário está pedindo ajuda (ou financiamento de ~$6k) para treinar um adaptador para modelos maiores, como Qwen3.6:27B.

Para quem é: Desenvolvedores executando agentes LLM locais em Apple Silicon que desejam experimentar a modulação de peso δ-mem para melhorar o desempenho de memória/contexto.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

🦀
Tools

Agente de IA OpenClaw com 6 Funções, Memória e Design Consciente de TDAH: Análise das Operações Diárias

Um fundador solo com TDAH criou um agente de IA de código aberto com 6 funções (planejador de ações, debriefing, redator, jurídico, investigador, CRM) compartilhando memória, gerando automaticamente follow-ups e rascunhos a partir de transcrições.

OpenClawRadar
Portable Mind Format (PMF): Especificação de Agente Independente de Provedor com 15 Agentes de Código Aberto
Tools

Portable Mind Format (PMF): Especificação de Agente Independente de Provedor com 15 Agentes de Código Aberto

O Portable Mind Format (PMF) é uma especificação baseada em JSON para definir identidades de agentes de IA que podem ser executados em vários modelos e provedores, incluindo Claude, GPT-4, Gemini, DeepSeek e modelos locais via Ollama. Inclui 15 agentes de produção com licença MIT e conversores para Claude Code, Cursor, GitHub Copilot e Gemini CLI.

OpenClawRadar
Ops Dashboard OpenClaw: Dashboard Local-Primeiro para Desenvolvedores Solo com Múltiplos Repos
Tools

Ops Dashboard OpenClaw: Dashboard Local-Primeiro para Desenvolvedores Solo com Múltiplos Repos

Um desenvolvedor solo criou o ops-dashboard, um aplicativo local-first que indexa vaults do Obsidian, repositórios e logs em um único painel consultável. BYOK, licença MIT, sem necessidade de nuvem.

OpenClawRadar
ByteRover Plugin de Memória para OpenClaw: Integração Nativa com Hierarquia Semântica
Tools

ByteRover Plugin de Memória para OpenClaw: Integração Nativa com Hierarquia Semântica

O Plugin de Memória ByteRover para OpenClaw oferece memória de longo prazo estruturada e nativa por meio de uma arquitetura de três camadas e hierarquia semântica armazenada em arquivos Markdown. Ele alcança 92,2% de precisão na recuperação e requer OpenClaw v2026.3.22+.

OpenClawRadar