AgentWorkingMemory : Un système de mémoire local pour les agents d'IA de codage

Ce que résout AgentWorkingMemory
Les agents d'IA de codage comme Claude Code manquent de mémoire persistante entre les sessions. Les développeurs doivent réexpliquer l'architecture, les schémas de base de données et les décisions précédentes à chaque nouvelle session, gaspillant du temps et de l'espace dans la fenêtre de contexte. Bien que Claude Code offre certains outils comme --continue pour reprendre les conversations, la mémoire automatique qui enregistre des notes dans des fichiers markdown, et la documentation de projet CLAUDE.md, ceux-ci ont des limites :
--continueou--resumerestaurent l'intégralité des fils de discussion mais consomment de l'espace dans la fenêtre de contexte et ne fonctionnent qu'avec un seul fil à la fois- La mémoire automatique charge les 200 premières lignes de
MEMORY.mdmais manque d'intelligence de récupération—elle ne sait pas quelles notes sont pertinentes pour le travail en cours - Les documents de projet comme
CLAUDE.mdfonctionnent pour les informations stables mais deviennent rapidement obsolètes dans les projets en évolution rapide
AgentWorkingMemory résout ces problèmes en accumulant des connaissances entre les sessions, en mettant en avant le contexte pertinent pour le travail actuel, et en s'améliorant avec le temps sans gestion manuelle.
Comment cela fonctionne
AWM fonctionne entièrement localement sur votre machine, sans dépendance au cloud. Le système se compose de :
- Une base de données SQLite pour le stockage
- Trois modèles ML locaux (~124 Mo au total, téléchargés une fois et mis en cache)
- Un processus Node.js
Il n'y a pas de serveur à exécuter, pas de conteneur Docker, et pas de démon en arrière-plan. Lorsque vous démarrez Claude Code, il lance automatiquement AWM via MCP (Model Context Protocol). Lorsque vous fermez la session, il s'arrête. Tout reste local—pas de cloud, pas de clés API, pas de données quittant votre machine. Pour une sécurité supplémentaire, AWM prend en charge l'authentification par jeton porteur pour verrouiller l'accès à l'API de mémoire.
Configuration et utilisation
L'installation nécessite deux commandes :
npm install -g agent-working-memory
awm setup --globalAprès avoir redémarré Claude Code, 14 outils de mémoire apparaissent automatiquement. La première session prend environ 30 secondes pendant le téléchargement des modèles ML (~124 Mo, mis en cache ensuite). À partir de là :
- L'agent enregistre des souvenirs lorsqu'il apprend quelque chose d'important
- Il rappelle les souvenirs pertinents lorsqu'il commence un nouveau travail
- Il sauvegarde son état pour récupérer après des interruptions
Le système a été développé lors de la refonte d'une base de code vieille de 20 ans (~1,4 million de lignes) vers une pile moderne (~250 000 lignes estimées), spécifiquement pour une plateforme de gestion d'adhésions avec 88 tables de base de données et un développement multi-sprints utilisant plusieurs agents d'IA en parallèle.
📖 Read the full source: r/ClaudeAI
👀 See Also

Version bêta de Claude Dispatch : conseils de configuration et premières impressions
Un développeur partage son expérience de configuration de la version bêta de Dispatch sur un Mac Mini, soulignant la nécessité d'une disponibilité constante, de critères de succès spécifiques et d'autorisations agressives avec Computer Use activé.

Serveur MCP Ultrahuman Ring non officiel pour l'intégration d'agents IA
Un serveur MCP développé par la communauté encapsule l'API Partenaire Ultrahuman, permettant aux agents d'IA de codage d'accéder directement aux métriques de l'anneau et du MCG comme le sommeil, la VRC, le glucose et les scores de récupération via des appels de données structurées.

GLM-5.1 vs MiniMax M2.7 : Comparaison des performances pour les agents d'IA de codage
GLM-5.1 atteint des scores de 77,8 sur SWE-bench-Verified et 56,2 sur Terminal Bench 2.0, les plus élevés parmi les modèles open source, tandis que MiniMax M2.7 offre des réponses rapides avec un faible TTFT et un débit élevé, idéal pour les bots d'intégration continue et les modifications par lots.

Claude Code ajoute un système de révision par équipe d'agents en prévisualisation de recherche
Claude Code intègre désormais un système complet de revue de code inspiré du processus interne d'Anthropic, utilisant des équipes d'agents. Cette fonctionnalité est disponible en version de recherche.