Testando δ-Mem no Apple Silicon: Implementação MLX e Benchmarks

Um usuário do Reddit implementou o artigo de pesquisa δ-mem (arXiv 2605.12357) para Apple Silicon usando mlx e integração OpenClaw. O artigo melhora a direção da atenção do modelo sem contexto ou LoRA, relatando respostas 20% melhores em seus testes. A implementação usou Qwen3-4B-Instruct via mlx e adaptadores personalizados.
Resultados dos Benchmarks (testes mlx normalizados, Qwen3-4B-Instruct em MacMini 64GB):
- Estilo sintético do artigo: Plain 0,5129, δ-mem 0,5129 (1,00x)
- LoCoMo-10 mini: Plain 0,0500, δ-mem 0,1833 (3,67x)
- Replay OpenClaw: Plain 0,5701, δ-mem 0,6667 (1,17x)
Custos de latência (vs plain):
- Sintético: 1,013x
- LoCoMo-10 mini: 1,33x query / 1,50x total
- Replay OpenClaw: 1,30x
Links importantes:
- Repositório GitHub com adaptador: delta-mem-mlx-sidecar-w-openclaw
- Adaptador MLX no Hugging Face: delta-mem-qwen3-4b-instruct-mlx-adapter
Conclusões:
- As sondas sintéticas ficaram planas (1,00x), mas o LoCoMo-mini mostrou fortes ganhos relativos (3,67x).
- O replay estilo OpenClaw mostrou uma melhoria praticamente significativa (6/8 → 7/8 sondas aprovadas, 1,17x).
- O usuário observa que o Apple Silicon não pode executar CUDA eficientemente, então os resultados são inferiores aos benchmarks do artigo. Os benchmarks do artigo (Qwen3-4B-Instruct) mostraram média de 1,10x vs backbone congelado, MemoryAgentBench 1,31x, LoCoMo 1,20x.
- O usuário está pedindo ajuda (ou financiamento de ~$6k) para treinar um adaptador para modelos maiores, como Qwen3.6:27B.
Para quem é: Desenvolvedores executando agentes LLM locais em Apple Silicon que desejam experimentar a modulação de peso δ-mem para melhorar o desempenho de memória/contexto.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also
Agente de IA OpenClaw com 6 Funções, Memória e Design Consciente de TDAH: Análise das Operações Diárias
Um fundador solo com TDAH criou um agente de IA de código aberto com 6 funções (planejador de ações, debriefing, redator, jurídico, investigador, CRM) compartilhando memória, gerando automaticamente follow-ups e rascunhos a partir de transcrições.

Portable Mind Format (PMF): Especificação de Agente Independente de Provedor com 15 Agentes de Código Aberto
O Portable Mind Format (PMF) é uma especificação baseada em JSON para definir identidades de agentes de IA que podem ser executados em vários modelos e provedores, incluindo Claude, GPT-4, Gemini, DeepSeek e modelos locais via Ollama. Inclui 15 agentes de produção com licença MIT e conversores para Claude Code, Cursor, GitHub Copilot e Gemini CLI.

Ops Dashboard OpenClaw: Dashboard Local-Primeiro para Desenvolvedores Solo com Múltiplos Repos
Um desenvolvedor solo criou o ops-dashboard, um aplicativo local-first que indexa vaults do Obsidian, repositórios e logs em um único painel consultável. BYOK, licença MIT, sem necessidade de nuvem.

ByteRover Plugin de Memória para OpenClaw: Integração Nativa com Hierarquia Semântica
O Plugin de Memória ByteRover para OpenClaw oferece memória de longo prazo estruturada e nativa por meio de uma arquitetura de três camadas e hierarquia semântica armazenada em arquivos Markdown. Ele alcança 92,2% de precisão na recuperação e requer OpenClaw v2026.3.22+.