Testando δ-Mem no Apple Silicon: Implementação MLX e Benchmarks

✍️ OpenClawRadar📅 Publicado: May 16, 2026🔗 Source
Testando δ-Mem no Apple Silicon: Implementação MLX e Benchmarks
Ad

Um usuário do Reddit implementou o artigo de pesquisa δ-mem (arXiv 2605.12357) para Apple Silicon usando mlx e integração OpenClaw. O artigo melhora a direção da atenção do modelo sem contexto ou LoRA, relatando respostas 20% melhores em seus testes. A implementação usou Qwen3-4B-Instruct via mlx e adaptadores personalizados.

Resultados dos Benchmarks (testes mlx normalizados, Qwen3-4B-Instruct em MacMini 64GB):

  • Estilo sintético do artigo: Plain 0,5129, δ-mem 0,5129 (1,00x)
  • LoCoMo-10 mini: Plain 0,0500, δ-mem 0,1833 (3,67x)
  • Replay OpenClaw: Plain 0,5701, δ-mem 0,6667 (1,17x)

Custos de latência (vs plain):

  • Sintético: 1,013x
  • LoCoMo-10 mini: 1,33x query / 1,50x total
  • Replay OpenClaw: 1,30x

Links importantes:

Conclusões:

Ad
  • As sondas sintéticas ficaram planas (1,00x), mas o LoCoMo-mini mostrou fortes ganhos relativos (3,67x).
  • O replay estilo OpenClaw mostrou uma melhoria praticamente significativa (6/8 → 7/8 sondas aprovadas, 1,17x).
  • O usuário observa que o Apple Silicon não pode executar CUDA eficientemente, então os resultados são inferiores aos benchmarks do artigo. Os benchmarks do artigo (Qwen3-4B-Instruct) mostraram média de 1,10x vs backbone congelado, MemoryAgentBench 1,31x, LoCoMo 1,20x.
  • O usuário está pedindo ajuda (ou financiamento de ~$6k) para treinar um adaptador para modelos maiores, como Qwen3.6:27B.

Para quem é: Desenvolvedores executando agentes LLM locais em Apple Silicon que desejam experimentar a modulação de peso δ-mem para melhorar o desempenho de memória/contexto.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

SlackClaw: Instância Gerenciada do OpenClaw para Integração com Slack
Tools

SlackClaw: Instância Gerenciada do OpenClaw para Integração com Slack

SlackClaw é um produto comercial baseado no OpenClaw que fornece uma instância gerenciada especificamente para o Slack. Oferece instalação com um clique, conexões de ferramentas OAuth, servidores dedicados por espaço de trabalho e memória persistente.

OpenClawRadar
LLMs Vazam Raciocínio em Saídas Estruturadas Apesar de Instruções Explícitas
Tools

LLMs Vazam Raciocínio em Saídas Estruturadas Apesar de Instruções Explícitas

Um desenvolvedor que construiu uma ferramenta que faz chamadas paralelas à API do Claude e analisa a saída estruturada descobriu que os modelos de validação ocasionalmente emitem texto de raciocínio antes do conteúdo corrigido, apesar de instruções explícitas para retornar apenas o texto corrigido. A correção envolveu o aperto do prompt mais uma função defensiva de remoção que é executada antes da análise.

OpenClawRadar
O plugin OpenClaw adiciona memória persistente com o servidor Engram.
Tools

O plugin OpenClaw adiciona memória persistente com o servidor Engram.

Um desenvolvedor criou um plugin em TypeScript que conecta agentes OpenClaw ao Engram, um servidor de memória leve baseado em Go que armazena observações estruturadas em SQLite com busca de texto completo FTS5. O plugin fornece 11 ferramentas, 4 ganchos de ciclo de vida e uma recuperação automática que injeta memórias relevantes nos prompts antes de cada turno do agente.

OpenClawRadar
JavaClaw Beta: Assistente de IA Baseado em Java Desenvolvido com Spring AI e JobRunr
Tools

JavaClaw Beta: Assistente de IA Baseado em Java Desenvolvido com Spring AI e JobRunr

A equipe do JobRunr lançou o JavaClaw beta, uma versão Java do OpenClaw que roda localmente com suporte a múltiplos canais, escolha de LLM e processamento de tarefas em segundo plano via JobRunr. Construído com Spring Boot 4, Spring AI e Spring Modulith.

OpenClawRadar