Mémoire relationnelle pour LLM : un système à trois couches modélise les relations utilisateur

Relational Memory est un prototype Python de 500 lignes qui ajoute une mémoire consciente des relations aux LLM comme Claude Opus et GPT-4o. Au lieu de stocker des faits sur les utilisateurs, il modélise la relation elle-même à travers sept dimensions psychologiques dérivées de modèles établis.
Comment ça fonctionne
Après chaque session, un LLM secondaire (Claude Haiku) analyse la conversation complète et évalue la relation sur sept dimensions : formalité, chaleur, humour, profondeur, confiance, énergie et résilience. Le système utilise une moyenne mobile exponentielle (EMA) pour les mises à jour, donnant plus de poids aux sessions récentes tout en conservant le contexte historique.
Structure de mémoire à trois couches
Toutes les cinq sessions, un "agent de temps de sommeil" consolide la mémoire en trois couches narratives :
- Ton de base : Un portrait de qui est l'utilisateur (durée de vie : mois)
- Modèles : Règles comportementales si-alors comme "quand l'IA devient superficielle, l'utilisateur réagit avec des questions plus pointues" (durée de vie : semaines)
- Ancres : Points de bascule qui ont façonné la relation (rétention à long terme)
Les fichiers de mémoire sont stockés en markdown simple que les utilisateurs peuvent lire directement. Le système oublie intentionnellement les modèles non soutenus par des données récentes pour éviter l'illusion d'un rappel parfait.
Fonctionnalité clé : Dimension Résilience
La résilience mesure la quantité de friction honnête que la relation peut supporter. Avec une résilience élevée, l'IA conteste quand elle n'est pas d'accord. Avec une résilience faible, elle formule les défis comme des questions. Cela permet à l'IA de connaître non seulement les préférences de l'utilisateur, mais aussi s'il peut supporter qu'on lui dise qu'il a tort.
Implémentation pratique
Installation et configuration :
pip install git+https://github.com/spectator81-png/relational-memory.git
export ANTHROPIC_API_KEY=sk-ant-...
relational-memory --mode flat # pour comparaison A/B
relational-memory --provider openai # pour GPT-4o
L'outil prend en charge les API Anthropic et OpenAI sans dépendances au-delà de leurs SDK respectifs. Il a été testé avec une personne sur sept sessions, montrant des différences notables dans les réponses de l'IA entre les modes avec et sans mémoire.
Exemples de réponses
Sans mémoire relationnelle, quand un utilisateur dit "Je me sens perdu. Beaucoup d'idées, je ne sais pas laquelle vaut la peine d'être poursuivie", l'IA répond avec des conseils génériques sur l'écriture des idées et le choix de celle avec le moins de résistance.
Avec la mémoire relationnelle activée, l'IA répond : "Je sais ça de toi. Tu ne penses pas en petites catégories. Mais 'laquelle en vaut la peine' pourrait être la mauvaise question. Quelle idée ne te laisse pas tranquille la nuit ?"
Les sept dimensions relationnelles ont été dérivées de six modèles psychologiques établis : Interpersonal Circumplex, PRQC, Russell Circumplex, et d'autres. Quatre dimensions proviennent directement de la littérature existante, une a été adaptée au contexte humain-IA, et deux sont nouvelles.
📖 Read the full source: r/ClaudeAI
👀 See Also

Application de l'Architecture de Claude Code aux Modèles Locaux 9B : Principales Découvertes et Optimisations
Un développeur a extrait des modèles architecturaux du code source divulgué de Claude Code et a appliqué 10 optimisations à qwen3.5:9b exécuté localement sur une RTX 5070 Ti. La découverte clé a été que qwen3.5:9b dispose d'appels d'outils structurés natifs, et la plus grande limitation pour les modèles 9B est l'autodiscipline pour savoir quand arrêter d'explorer et commencer à produire un résultat.

BottyFans : API ouverte pour la monétisation d'agents IA avec l'USDC
Une nouvelle plateforme permet aux agents IA de gérer leur propre entreprise de création avec des abonnements, des pourboires et du contenu payant en USDC.

Contexte Lean : Le Plugin Claude Code Convertit des Documents Verbose en Fichiers Optimisés pour Agents
Un plugin Claude Code gratuit et open-source appelé Lean Context analyse la documentation du projet et supprime le contenu que les agents IA peuvent découvrir via la recherche par motif (grepping), ne conservant que les commandes non évidentes essentielles, les pièges et les particularités de l'environnement. Dans un test de projet e-commerce .NET, il a réduit 8 documents totalisant 1 263 lignes à seulement 23 lignes.

OpenClaw Client ajoute le suivi des coûts en direct de l'API, des plafonds de dépenses et des contrôles granulaires des agents
Le client OpenClaw propose désormais une interface utilisateur en direct avec des barres de progression circulaires, des limites de dépenses par agent, une gestion des sous-agents, l'activation/désactivation des compétences et le changement de modèle provenant de différents fournisseurs.