Graphe de Compétences Traversable pour la Mémoire Persistante des Agents IA dans les Bases de Code

Une Solution Pratique pour les Assistants IA sans État
Les assistants de codage IA manquent de mémoire persistante entre les sessions, forçant les développeurs à repartir de zéro à chaque fois. L'approche courante qui consiste à tout déverser dans de grands fichiers de règles comme .cursorrules échoue en raison des limites de tokens et de la dilution des instructions.
La solution présentée est une divulgation progressive via un graphe de compétences traversable qui vit à l'intérieur de la base de code. L'IA navigue ce graphe de manière autonome à travers les sessions.
Architecture à Trois Couches
Le système possède trois couches distinctes :
- Couche 1 (Toujours Chargée) : Moins de 150 lignes (300 tokens). Contient l'identité de la pile, les conventions de dossiers et les non-négociables. Inclut un pointeur sortant vers
HANDOVER.md. - Couche 2 (Chargée Par Session) :
HANDOVER.mdsert de routeur d'attention, pas de document. Il indique à l'IA quel fichier de domaine charger en fonction de la tâche actuelle (paiements, authentification, base de données, routes API). Chaque fichier de domaine se termine par des instructions pointant vers le fichier suivant pertinent, créant un système auto-dirigé. - Couche 3 (Chargée Par Tâche) : Bibliothèque d'invites avec 12 catégories. Chaque entrée comprend des sections de contexte, construction, vérification et débogage. L'IA consulte l'index, charge la catégorie et suit le modèle.
Idée Clé : Instructions Auto-Dirigées
L'innovation principale est que les instructions portent du sens, pas seulement des références. Par exemple : "chargez security/threat-modeling.md avant de modifier les gestionnaires de webhooks" indique à l'IA quand et pourquoi, pas seulement quoi.
Le développeur a intégré cela dans un modèle SaaS livré avec la base de code, disponible sur launchx.page pour ceux qui souhaitent examiner la structure complète du graphe.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

RTX 5060 Ti 16GB : Benchmarks des LLM locaux : Les modèles 30B restent en tête pour le codage
Les benchmarks sur une RTX 5060 Ti 16GB montrent que le modèle Unsloth Qwen3-Coder-30B UD-Q3_K_XL atteint 76,3 tok/s sur Ubuntu avec un score de qualité de 8,14, ce qui en fait le modèle de codage recommandé par défaut. Le modèle Unsloth Qwen3.5-35B UD-Q2_K_XL atteint 80,1 tok/s mais avec des scores de qualité inférieurs.

Memex : Extension de mémoire open source pour Claude Cowork
Memex est un plugin open-source qui donne à Claude Cowork une mémoire persistante entre les sessions grâce à un système de chargement de contexte par niveaux. Après avoir exécuté /memex:init une fois, Claude se met à jour en environ 20 secondes par session et reprend là où vous vous étiez arrêté.

Smriti : Un système similaire à Git pour gérer l'état de raisonnement des LLM afin d'éviter la dérive des conversations
Smriti est un outil open-source qui permet aux développeurs de sauvegarder, restaurer, brancher et comparer les états de raisonnement dans les conversations LLM pour éviter la dérive. Il traite les interactions comme un état plutôt que comme un historique de discussion, permettant des retours en arrière propres et une exploration alternative sans contamination.

Compétence apple-music-play OpenClaw publiée sur ClawHub pour la recherche et la lecture Apple Music
La compétence apple-music-play publiée sur ClawHub permet de rechercher dans le catalogue en ligne d'Apple Music et de lire des morceaux directement dans l'application Musique de macOS, sans nécessiter que les chansons soient dans votre bibliothèque locale.