Uma Camada de Governança de 7 Arquivos para Prevenir o Desvio de Sessão de LLM

Um desenvolvedor no r/LocalLLaMA compartilhou uma solução para impedir que assistentes de codificação baseados em LLM, como o Claude, desfaçam silenciosamente decisões arquiteturais entre sessões. Em vez de tratar as sessões de LLM como conversas, agora as tratam como processos sem estado que precisam de um protocolo.
O Problema Central
Cada sessão de LLM começa com memória zero. Você reexplica, o modelo reinterpreta e ele se desvia com confiança. O desenvolvedor observou: "Você nem vai perceber até estar bem dentro do projeto, talvez três ou quatro arquivos adiante, ou quem sabe até na última parte do projeto."
A Camada de Governança de 7 Arquivos
A solução não é um prompt melhor, mas uma camada de governança que qualquer modelo pode ler e operar imediatamente dentro dela. O sistema usa sete arquivos, cada um com uma preocupação específica, sem sobreposição:
active_context.md- Controlador da sessão, define o que está no escopo no momentocontracts.md- Lei comportamental, esquemas de dados, valores de enumeração, comportamento exigidoagent_core.md- Disciplina de execução, como operar, validar, relataragent_project.md- Intenção do projeto, por que este sistema existe, resultados esperadosdecisions.md- Registro de ADR, escolhas não óbvias e por que foram aceitasbuild_plan.md- Roteiro do módulo, ordem de implementação e entregasstate.md- Diário vivo, o que foi feito, o que mudou, o que resta
Decisões de Design Principais
O desenvolvedor explicou duas separações críticas:
Separar contracts.md de agent_core.md: "Quando um conflito comportamental aparecia, o modelo não tinha como saber a qual camada deferir. Era uma regra de esquema ou uma preferência de execução? Quando estão separados, a hierarquia é inequívoca, os contratos sempre vencem."
Incluir decisions.md: "Quase pulei isso ('Vou lembrar'). Três semanas depois, não conseguia reconstruir por que escolhemos Postgres em vez de SQLite para um módulo específico. O registro ADR existe exatamente porque 'Vou lembrar' não é um protocolo."
O Loop Operacional
Toda sessão segue esta ordem, sem exceções:
- Ler
active_context.md→ extrair o que está no escopo - Reaterrar contra
contracts.md→ regras comportamentais travadas - Confirmar restrições operacionais de
agent_core.md+agent_project.md - Verificar
decisions.md→ não reverter escolhas aceitas - Executar apenas o que
active_context.mdautoriza, conformebuild_plan.md - Validar com testes — não declarar como concluído sem evidências
- Atualizar
state.mdcom resultados factuais - Se uma nova decisão não trivial foi tomada, registrá-la em
decisions.md
Impacto no Fluxo de Trabalho
O bloqueio de escopo do active_context.md provou ser particularmente valioso: "Antes disso, eu começava uma sessão para corrigir um bug e acabava refatorando um módulo não relacionado porque 'estava ali mesmo'. Parecia produtivo......... e era."
📖 Read the full source: r/LocalLLaMA
👀 See Also

Sistema de Memória Baseado em Arquivos do Claude Code: Uma Alternativa Pragmática aos Bancos de Dados Vetoriais
O Claude Code implementa um sistema de memória baseado em arquivos usando arquivos .md com metadados frontmatter e um índice MEMORY.md, evitando bancos de dados vetoriais e pipelines de embedding ao escanear arquivos, construir manifestos e usar um modelo pequeno para selecionar memórias relevantes.

Painel de Sessões do Claude Code: Ferramenta de Código Aberto para Monitoramento de Múltiplas Sessões
Um painel de código aberto que monitora várias sessões do Claude Code simultaneamente, mostrando uso de tokens, custos, status da sessão, uso da janela de contexto e subagentes ativos. A instalação requer três comandos: git clone, cd e npm install && npm start.

Memória Relacional para LLMs: Sistema de Três Camadas Modela Relações do Usuário
Uma ferramenta Python de código aberto que adiciona memória relacional a LLMs, modelando relacionamentos usuário-IA em sete dimensões psicológicas, usando uma estrutura narrativa de três camadas em vez de armazenamento plano de fatos.

Executando NemoClaw com vLLM Local: Notas de Configuração e Observações de Engenharia de Agentes
Um desenvolvedor documentou a execução da plataforma de agentes de IA em sandbox NemoClaw da NVIDIA com um modelo local Nemotron 9B v2 via vLLM no WSL2. As principais descobertas incluem detalhes de roteamento de inferência, problemas de compatibilidade do analisador e observações sobre a lacuna na engenharia de agentes.