Une couche de gouvernance à 7 fichiers pour prévenir la dérive de session des LLM

Un développeur sur r/LocalLLaMA a partagé une solution pour empêcher les assistants de codage LLM comme Claude d'annuler silencieusement des décisions architecturales entre les sessions. Au lieu de traiter les sessions LLM comme des conversations, ils les traitent désormais comme des processus sans état qui nécessitent un protocole.
Le problème central
Chaque session LLM commence avec une mémoire nulle. Vous réexpliquez, elle réinterprète, et elle dérive avec confiance. Le développeur a noté : "Vous ne le remarquerez même pas avant d'être profondément dans le projet, peut-être trois ou quatre fichiers plus loin, ou qui sait, même à la dernière partie du projet."
La couche de gouvernance à 7 fichiers
La solution n'est pas un meilleur prompt mais une couche de gouvernance que n'importe quel modèle peut lire et utiliser immédiatement. Le système utilise sept fichiers, chacun possédant une préoccupation spécifique sans chevauchement :
active_context.md- Contrôleur de session, définit ce qui est dans le champ d'application actuelcontracts.md- Loi comportementale, schémas de données, valeurs d'énumération, comportement requisagent_core.md- Discipline d'exécution, comment opérer, valider, rapporteragent_project.md- Intention du projet, pourquoi ce système existe, résultats attendusdecisions.md- Journal ADR, choix non évidents et pourquoi ils ont été acceptésbuild_plan.md- Feuille de route des modules, ordre d'implémentation et livrablesstate.md- Journal vivant, ce qui est fait, ce qui a changé, ce qui reste
Décisions de conception clés
Le développeur a expliqué deux séparations critiques :
Séparer contracts.md de agent_core.md : "Lorsqu'un conflit comportemental est apparu, le modèle n'avait aucun moyen de savoir à quelle couche se référer. Était-ce une règle de schéma ou une préférence d'exécution ? Lorsqu'elles sont séparées, la hiérarchie est sans ambiguïté, les contrats l'emportent toujours."
Inclure decisions.md : "J'ai failli le sauter ('Je m'en souviendrai'). Trois semaines plus tard, je ne pouvais pas reconstruire pourquoi nous avions choisi Postgres plutôt que SQLite pour un module spécifique. Le journal ADR existe précisément parce que 'Je m'en souviendrai' n'est pas un protocole."
La boucle opérationnelle
Chaque session suit cet ordre, sans exception :
- Lire
active_context.md→ extraire ce qui est dans le champ d'application - Se réancrer contre
contracts.md→ règles comportementales verrouillées - Confirmer les contraintes opérationnelles de
agent_core.md+agent_project.md - Vérifier
decisions.md→ ne pas inverser les choix acceptés - Exécuter uniquement ce que
active_context.mdautorise, selonbuild_plan.md - Valider avec des tests — ne pas déclarer terminé sans preuve
- Mettre à jour
state.mdavec les résultats factuels - Si une nouvelle décision non triviale a été prise, la consigner dans
decisions.md
Impact sur le flux de travail
Le verrouillage de portée de active_context.md s'est avéré particulièrement précieux : "Avant cela, je commençais une session pour corriger un bug et je finissais par refactoriser un module non lié parce que 'il était juste là'. Cela semblait productif.........et ça l'était."
📖 Read the full source: r/LocalLLaMA
👀 See Also

Le Framework AutoAgents Rust Ajoute des Liaisons Python pour le Prototypage
AutoAgents, un framework multi-agent basé sur Rust, dispose désormais de liaisons Python qui permettent aux développeurs de prototyper en Python tout en conservant le même runtime central Rust, les interfaces de fournisseurs, le modèle de pipeline et la sémantique des agents. Les liaisons permettent d'expérimenter avec des modèles d'IA locaux sans systèmes externes.

DeepClaude remplace le backend Anthropic de Claude Code par DeepSeek V4 Pro à un coût 17 fois inférieur
Un script qui réécrit les variables d'environnement de Claude Code pour router tous les appels de la boucle agent via DeepSeek V4 Pro, OpenRouter ou Fireworks AI — même UX, 0,87 $/M tokens de sortie contre 15 $/M.

NGX-OS : Système d'exploitation réseau conçu pour l'IA avec intégration eBPF et MCP
NGX-OS est un système d'exploitation réseau conçu dès le départ pour l'intégration de l'IA, utilisant eBPF pour la télémétrie en temps réel et MCP pour un accès direct des LLM aux données d'état du réseau sans couches de traduction.

Forge : Un système de mémoire pour Claude Code construit avec Claude Code
Un développeur a créé Forge, un serveur MCP monorepo TypeScript qui capture automatiquement les décisions, contraintes et rejets des conversations avec Claude Code. Il utilise un pipeline en six étapes pour classer, extraire et persister des données structurées dans un modèle SQLite basé sur les événements.