Système de Mémoire Bio-Inspiré pour LLM Locaux : Mise en œuvre de la PLT et de l'Oubli Sélectif

Architecture de Mémoire Bio-Inspirée pour LLMs Locaux
Un développeur a créé un serveur MCP local qui simule les mécanismes de mémoire humaine pour maintenir un contexte propre aux LLMs locaux. Le système implémente trois couches bio-inspirées en Python/TypeScript au lieu d'un pipeline RAG statique.
Mécanismes de Mémoire Fondamentaux
- Renforcement (Potentialisation à Long Terme) : Chaque fois qu'un sujet est interrogé, son
access_countaugmente, renforçant les souvenirs fréquemment consultés. - Oubli Sélectif : Les connexions inutilisées se dégradent avec le temps, le système archivant automatiquement les atomes faibles pour éviter la pollution du contexte.
- Consolidation : Un cycle de "sommeil" hebdomadaire distille les journaux récents en atomes de connaissances fondamentaux en utilisant un SLM léger.
Détails d'Implémentation Technique
- Recherche Hybride : Combine
sqlite-vecpour la recherche sémantique avec des solutions de repli textuelles pour éviter les délais d'attente même si les embeddings échouent. - MCP Non-Bloquant : Enveloppe les opérations synchrones de base de données et d'embedding dans des exécuteurs
asynciopour garder LM Studio réactif. - Couche d'Identité : Utilise un fichier persistant "Soul" (
soul.md) pour maintenir l'état et la personnalité entre les sessions. - Renforcement Basé sur l'Accès : Le mécanisme
access_countpermet au modèle d'évoluer en fonction des schémas d'interaction plutôt que de simplement récupérer des faits statiques.
Contexte de Développement et Validation
Le projet a été développé pour répondre aux limites de contexte dans les implémentations RAG standard pour l'IA locale. Le développeur a validé l'architecture en faisant analyser la base de code par un LLM local (exécutant Gemini), qui a mis en évidence trois innovations : de véritables agents cognitifs utilisant le renforcement basé sur l'accès et la dégradation, une recherche hybride robuste avec solutions de repli, et une architecture non-bloquante pour la réactivité.
L'objectif est de créer un système qui se souvient de ce qui compte et oublie le bruit, similaire à la mémoire humaine pendant le sommeil. Le développeur explore si les architectures de mémoire bio-inspirées peuvent résoudre les limitations de contexte localement sans dépendances cloud ou boîtes noires.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Microsoft VibeVoice : modèles ASR de 60 min et TTS de 90 min open-sourcés
VibeVoice est une famille de modèles de voix IA open-source de Microsoft incluant ASR (60 minutes en un seul passage, diarisation des locuteurs, plus de 50 langues) et TTS (90 minutes multi-locuteur, streaming en temps réel). Utilise des tokenizers de parole continus à 7,5 Hz et une diffusion de prochain token.

Marky : Un Visionneur Markdown Léger pour la Documentation Générée par des Agents
Marky est un visualiseur de markdown pour bureau développé avec Tauri v2 et React qui ouvre les fichiers .md depuis le terminal avec rechargement en direct. Il propose une utilisation prioritaire en CLI, une coloration syntaxique avec Shiki, une prise en charge des formules mathématiques avec KaTeX, des diagrammes Mermaid et des espaces de travail pour les dossiers.

Testreel : Génération de vidéos de démonstration programmatiques avec Claude Code
Testreel est un package npm qui génère des vidéos de démonstration de produits polies à partir de descriptions d'interactions JSON, YAML ou Playwright. Il crée des vidéos webm/mp4/gif avec des superpositions de curseur, des ondulations de clic et des arrière-plans dégradés.

Graph Compose : Flux de travail temporels hébergés avec constructeur visuel et IA
Graph Compose est une plateforme hébergée pour orchestrer des flux de travail d'API sur Temporal, vous permettant de définir des workflows sous forme de graphes JSON avec trois méthodes de construction : un constructeur visuel React Flow, un SDK TypeScript et un assistant IA qui convertit l'anglais simple en graphes.