Système de mémoire basé sur les fichiers de Claude Code : une alternative pragmatique aux bases de données vectorielles

Claude Code utilise une approche basée sur des fichiers pour la mémoire des agents, remplaçant la configuration typique de base de données vectorielle et d'embeddings. Au lieu d'un RAG complet, il stocke les mémoires sous forme de fichiers .md avec de petites sections frontmatter contenant des informations de nom, description et type, plus un fichier MEMORY.md qui sert d'index.
Fonctionnement du système
Au moment de l'exécution, le système n'incorpore ni ne recherche tout. Il suit ce processus :
- Scanne les fichiers de mémoire (limités à environ 200, les plus récents en premier)
- Lit seulement les ~30 premières lignes (principalement des métadonnées)
- Construit un manifeste léger
- Utilise un petit modèle pour choisir les ~5 mémoires les plus pertinentes
- Charge uniquement ces mémoires sélectionnées dans le contexte (avec des limites de taille)
Avantages clés
La conception offre plusieurs avantages pratiques :
- Économique : Fichiers limités, tokens limités, coûts prévisibles
- Rapide : Aucune opération d'embedding ou de recherche de similarité
- Contrôlé : N'injecte que quelques mémoires avec des plafonds stricts partout
- Lisible par l'humain : Tout est stocké sous forme de fichiers markdown
- Moins de déchets : Évite explicitement de stocker des informations qui peuvent déjà être dérivées du dépôt
Le système traite la mémoire comme "potentiellement obsolète" plutôt que comme une vérité absolue, ce qui offre une approche rafraîchissante de la gestion de la mémoire des agents. Cette conception est particulièrement pragmatique pour les agents de codage et de débogage où la plupart des "mémoires" consistent en des préférences, du contexte ou des références externes plutôt que de grandes bases de connaissances.
Bien que cette approche ne remplace pas le RAG pour tous les cas d'utilisation, elle représente un bon compromis pour les agents de développement où la simplicité et la prévisibilité comptent plus qu'une récupération complète des connaissances.
📖 Read the full source: r/ClaudeAI
👀 See Also

SIDJUA v0.9.7 : Intelligence Artificielle Multi-Agents Open Source avec Application Pré-Action de la Gouvernance
SIDJUA v0.9.7 est un framework d'IA multi-agents open source et auto-hébergé qui applique des règles de gouvernance avant que les agents n'agissent, bloquant les actions non autorisées comme les dépassements de budget ou les violations de périmètre. Il prend en charge plusieurs fournisseurs de LLM, fonctionne avec 4 Go de RAM et inclut une interface graphique de bureau construite avec Tauri v2.

Bespoke AI v0.8.1 : Extension d'auto-complétion VS Code pour le code et le texte
Bespoke AI v0.8.1 est une extension VS Code qui fournit une fonctionnalité d'autocomplétion à la fois pour le code et le texte, exploitant les abonnements Claude Code via le SDK Agent d'Anthropic pour éviter les frais d'API tout en prenant en charge plusieurs backends dont Ollama.

Memtrace : Mémoire persistante et temporelle de la base de code pour les agents Claude Code
Memtrace fournit des instantanés toujours à jour et une relecture bi-temporelle pour les agents Claude Code, en utilisant l'analyse AST Tree-sitter et une récupération hybride (BM25 + embeddings Jina-code) sans aucun coût d'inférence LLM lors de l'indexation.

Cadre d'Équipe de Recherche en Boîte pour Claude Code Utilisant une Architecture Multi-Agents
Un développeur a créé un cadre de recherche multi-agents pour Claude Code qui utilise Opus 4.6 pour coordonner des agents spécialisés via un plugin appelé research-clab. Le cadre se déploie via un processus guidé de questions-réponses et comprend 11 compétences, des définitions d'agents et des répertoires structurés pour gérer des projets de recherche complexes.