Test de δ-Mem sur Apple Silicon : Implémentation MLX et Benchmarks

✍️ OpenClawRadar📅 Publié: May 16, 2026🔗 Source
Test de δ-Mem sur Apple Silicon : Implémentation MLX et Benchmarks
Ad

Un utilisateur de Reddit a implémenté l'article de recherche δ-mem (arXiv 2605.12357) pour Apple Silicon en utilisant mlx et l'intégration OpenClaw. L'article améliore la direction de l'attention du modèle sans contexte ni LoRA, rapportant 20 % de meilleures réponses dans leurs tests. L'implémentation a utilisé Qwen3-4B-Instruct via mlx et des adaptateurs personnalisés.

Résultats des benchmarks (tests mlx normalisés, Qwen3-4B-Instruct sur MacMini 64 Go) :

  • Synthétique style article : Plain 0,5129, δ-mem 0,5129 (1,00x)
  • LoCoMo-10 mini : Plain 0,0500, δ-mem 0,1833 (3,67x)
  • Replay OpenClaw : Plain 0,5701, δ-mem 0,6667 (1,17x)

Coûts en latence (vs plain) :

  • Synthétique : 1,013x
  • LoCoMo-10 mini : 1,33x requête / 1,50x total
  • Replay OpenClaw : 1,30x

Liens clés :

Points clés :

Ad
  • Les sondes synthétiques étaient plates (1,00x), mais LoCoMo-mini a montré de forts gains relatifs (3,67x).
  • Le replay de style OpenClaw a montré une amélioration pratiquement significative (6/8 → 7/8 sondes réussies, 1,17x).
  • L'utilisateur note qu'Apple Silicon ne peut pas exécuter CUDA efficacement, donc les résultats sont inférieurs aux benchmarks de l'article. Les benchmarks de l'article (Qwen3-4B-Instruct) montraient une moyenne de 1,10x vs modèle figé, MemoryAgentBench 1,31x, LoCoMo 1,20x.
  • L'utilisateur cherche de l'aide (ou un financement d'environ 6 000 $) pour entraîner un adaptateur pour des modèles plus grands comme Qwen3.6:27B.

À qui cela s'adresse : Développeurs exécutant des agents LLM locaux sur Apple Silicon qui souhaitent expérimenter la modulation de poids δ-mem pour améliorer les performances mémoire/contexte.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

État des outils de recherche approfondie locale : GPT Researcher et Local Deep Research en tête, projets STORM et LangChain à l'arrêt
Tools

État des outils de recherche approfondie locale : GPT Researcher et Local Deep Research en tête, projets STORM et LangChain à l'arrêt

Un sondage Reddit sur les projets locaux de recherche approfondie en mai 2026 révèle que GPT Researcher et Local Deep Research de LearningCircuit sont les plus actifs ; STORM et Open Deep Research de LangChain sont abandonnés ou semi-abandonnés.

OpenClawRadar
Phantom : Un agent d'IA persistant construit avec le SDK Agent de Claude
Tools

Phantom : Un agent d'IA persistant construit avec le SDK Agent de Claude

Phantom est un processus open-source Bun/TypeScript qui encapsule le SDK Agent de Claude (Opus 4.6) avec une mémoire vectorielle persistante, un moteur d'auto-évolution et une interface serveur MCP. Il fonctionne en continu sur sa propre machine virtuelle ou via Docker Compose et communique via Slack.

OpenClawRadar
AgentWorkingMemory : Un système de mémoire local pour les agents d'IA de codage
Tools

AgentWorkingMemory : Un système de mémoire local pour les agents d'IA de codage

AgentWorkingMemory (AWM) est un système de mémoire locale qui résout le problème d'amnésie de session à session chez les agents d'IA de codage. Il utilise une base de données SQLite, trois modèles ML locaux (~124 Mo au total) et s'intègre automatiquement via MCP pour fournir une mémoire persistante et contextuelle entre les sessions de Claude Code.

OpenClawRadar
WAYD : Une pause sociale de 60 secondes dans Claude Code, Cursor, et Copilot CLI
Tools

WAYD : Une pause sociale de 60 secondes dans Claude Code, Cursor, et Copilot CLI

WAYD est un plugin pour Claude Code, Cursor et Copilot CLI qui permet de poster une ligne d'humeur sur votre journée de code sous des mood-tags et de défiler un fil de réactions d'autres développeurs — le tout depuis votre terminal, propulsé par GitHub Issues.

OpenClawRadar