agent-recall : MCP SQLite local pour une mémoire de code Claude persistante

Résoudre le problème de mémoire de session de Claude Code
Claude Code oublie tout entre les sessions, obligeant les utilisateurs à réexpliquer les détails de l'équipe, les décisions et les blocages. Bien que CLAUDE.md fonctionne pour des projets uniques, cela devient désordonné sur plusieurs projets avec des contextes conflictuels.
agent-recall aborde ce problème avec une couche de mémoire locale basée sur SQLite qui persiste entre les sessions sans dépendances cloud.
Comment ça fonctionne
- Un seul fichier SQLite en mode WAL - pas de cloud, pas de base de données vectorielle, rien ne quitte votre machine
- 9 outils MCP qui permettent à Claude de sauvegarder des entités, des relations et des observations pendant que vous travaillez
- Au début de chaque session, une IA génère un résumé structuré couvrant les personnes clés, les décisions récentes et les blocages actifs au lieu de déverser des données brutes
- Historique des emplacements versionnés - les anciennes valeurs sont archivées, pas écrasées
Fonctionnalités principales
Comparé à claude-memory-mcp (qui est excellent pour les mémoires libres), agent-recall propose :
- Modèle entité-relation pour les données structurées
- Visibilité limitée pour contrôler quel projet voit quel contexte
- Résumés générés par IA plutôt que de charger des faits bruts dans le contexte
Configuration
L'installation est simple :
pip install 'agent-recall[mcp]'Ensuite, ajoutez le serveur à votre fichier de configuration .mcp.json. L'outil est sous licence MIT avec 321 tests et a été développé en exécutant environ 30 agents quotidiennement pour le travail.
L'auteur soulève une question intéressante sur les approches d'implémentation : les résumés générés par IA sont-ils réellement meilleurs que le chargement de faits bruts dans le contexte ? Cela reflète les expérimentations en cours dans l'écosystème MCP sur les stratégies optimales de gestion de la mémoire.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Benchmark Flash-MOE sur M5 Max : 12,99 tok/s avec Qwen3.5-397B
Un benchmark du modèle Qwen3.5 de 397 milliards de paramètres exécuté localement sur un MacBook Pro M5 Max avec 128 Go de RAM a atteint 12,99 tokens par seconde en utilisant une quantification 4 bits et cache-io-split 4, soit trois fois plus rapide que le benchmark original de 48 Go.

NVIDIA annonce la plateforme d'agent NemoClaw avec des contrôles de confidentialité
NVIDIA a lancé NemoClaw, une plateforme d'agents qui permet aux utilisateurs d'installer les modèles Nimotron et l'environnement d'exécution Open Shell avec une seule commande, tout en ajoutant des contrôles de confidentialité et de sécurité pour les agents autonomes.

Fonctionnalités non documentées de Claude Code : Hooks, mémoire, classificateur YOLO et plus
Le code source de Claude Code révèle des configurations cachées : classificateur YOLO pour l'auto-permission, hooks qui réécrivent les commandes, mémoire persistante de l'agent, règles de mode automatique en français courant et boucles de rêve.

Le dépôt des bonnes pratiques de Claude Code atteint 50 000 étoiles, entièrement construit avec des agents IA
Un dépôt GitHub rempli de bonnes pratiques pour Claude, développé et maintenu à 100 % par des workflows autonomes de Claude Code, a dépassé les 50 000 étoiles — devenant ainsi le dépôt le plus étoilé du Pakistan en 2026.