MuninnDB ajoute Dream Engine pour la consolidation de la mémoire LLM avec isolation des coffres-forts.

MuninnDB a ajouté une fonctionnalité Moteur de Rêve pour la consolidation de mémoire LLM, inspirée de la consolidation du sommeil dans le cerveau. L'outil open-source est écrit en Go et inclut la décroissance d'Ebbinghaus, l'apprentissage associatif de Hebb et des capacités de recherche vectorielle.
Fonctionnement du Moteur de Rêve
Le pipeline de consolidation s'exécute entre les sessions et effectue plusieurs opérations :
- Abaisse le seuil de similarité cosinus de déduplication de 0,95 à 0,85
- Marque les clusters de quasi-doublons
- Soumet les cas ambigus à un LLM pour une revue sémantique
- Fusionne automatiquement les doublons évidents
Vous pouvez l'exécuter avec une option de simulation : muninn dream --dry-run. Un exemple de sortie montre : "Aucun changement n'a été écrit. Rêve terminé en 0s par défaut, 107 engrammes scannés (9 fusionnés) documents-juridiques 1 engramme (protégé, ignoré)"
Niveaux de confiance des coffres-forts pour l'isolation des données
Le système met en œuvre la protection des données via des niveaux de confiance des coffres-forts :
- Coffres juridiques : Complètement ignorés, jamais envoyés à aucun LLM
- Travail/personnel : Ollama ou Anthropic uniquement
- Global/projets : Tout fournisseur configuré
État de développement et architecture
L'auteur a livré la Phase 0 avec déduplication configurable et CLI de simulation. La phase suivante (PR #2) ajoutera la consolidation LLM, la stabilité bidirectionnelle et une fonctionnalité de journal de rêve.
L'outil fonctionne localement sur du matériel grand public - l'auteur mentionne utiliser une RTX 5070 Ti avec Ollama. L'architecture est détaillée dans un document technique qui explore les parallèles avec les neurosciences.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

Lore : Un outil qui extrait un contexte structuré des conversations de codage avec l'IA
Lore est un outil basé sur navigateur construit avec Claude Code qui extrait un contexte structuré des conversations d'IA, capturant les décisions, les TODOs, les blocages et les listes de reprise. C'est une PWA React + TypeScript avec une extension Chrome pour la capture directe des conversations et l'injection de contexte.

Qwen 3.5 35B Fonctionnant sur 8 Go de VRAM avec la configuration llama.cpp
Un développeur partage sa configuration llama.cpp pour exécuter Qwen 3.5 35B (Q4_K_M GGUF) sur une RTX 4060m avec 8 Go de VRAM, obtenant 700 t/s de traitement de prompt et 42 t/s de génération, et discute de l'utilisation de Cline dans VSCode avec les modes kat-coder-pro et qwen3.5.

Explorer l'IA avec des Micro-robots : Comprendre les Agents IA grâce au Tuteur Nanorobot
Un membre de la communauté OpenClaw partage ses réflexions avec le 'Nanobot Tutor', un mini-cadre visant à démystifier le fonctionnement des agents d'IA. Découvrez comment plonger dans cet environnement d'apprentissage compact révèle les mécanismes des agents intelligents.
Claudy : un wrapper macOS natif pour Claude Code avec sessions multiples, changement automatique de compte et brouillons de commits
Claudy est une application native macOS conçue avec SwiftUI + SwiftData qui enrobe Claude Code, ajoutant la gestion multi-session, le changement automatique de compte en cas de limite de débit, les commits de brouillon pour les points de contrôle en cours de session, et un marché pour les Skills, MCPs et Commandes.