Gerenciando Contexto de IA com um Armazenamento de Conhecimento SQLite e Ferramentas MCP

Um ponto problemático comum com agentes de codificação de IA: os arquivos CLAUDE.md crescem para milhares de linhas, consumindo orçamento de contexto e fazendo com que a IA ignore metade das regras de qualquer maneira. Um desenvolvedor no r/ClaudeAI construiu um sistema para resolver isso — RunawayContext (licenciado sob MIT, atualmente usado para integrações de gestão de construção na Vista, Procore, Monday.com, etc.).
Arquitetura
A ideia central: mover conhecimento profundo de um arquivo markdown simples para um banco de dados SQLite com busca em texto completo (FTS5) e busca vetorial opcional via sqlite-vec. Em vez de carregar tudo a cada sessão, apenas um pequeno resumo por projeto (~150 linhas), uma constituição global (~200 linhas) e uma "memória viva" baseada em ponteiros (~50 linhas) são carregados antecipadamente. A IA consulta o banco de dados sob demanda usando ferramentas MCP como search_lessons e get_chunk.
Detalhes Chave de Implementação
- Matemática de tokens: O equivalente a ~280K tokens ainda existe — eles estão apenas no banco de dados, não carregados no contexto. A IA puxa o que precisa no meio da tarefa.
- Limites fixos em código: O regenerador recusa escrever um resumo que ultrapasse seu limite de 150 linhas. 15 regras arquiteturais nomeadas têm testes de CI associados que falham na build se a regra se desviar.
- Recuperação híbrida: A busca apenas vetorial foi pior que a híbrida. O sistema combina pontuações de palavras-chave FTS5 com pontuações vetoriais do sqlite-vec para obter melhores resultados.
- Humano no loop: A IA escreve novas lições em uma caixa de entrada de rascunhos. Um humano deve aprovar antes da promoção para o repositório de conhecimento, evitando ruído.
- Voz preservada: Os resumos gerados automaticamente contêm um bloco curado manualmente, delimitado por marcadores
<!-- PRESERVE_START -->. O regenerador mantém essa seção intacta enquanto regenera tudo ao redor.
Lições Aprendidas
- Imponha regras em código, não em política — toda instrução de "cuidado para não crescer" foi violada em poucos meses.
- A recuperação híbrida FTS5 + vetorial supera a busca apenas vetorial.
- Escritas diretas da IA no repositório de conhecimento introduzem ruído; use uma caixa de entrada de rascunhos com aprovação manual.
O sistema é agnóstico em relação ao agente e o repositório é público para qualquer um adaptar.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Porto em Go de código aberto do CLI Claude Code lançado como claw-code-go
O desenvolvedor dolm09 lançou o claw-code-go, uma porta completa em Go do CLI Claude Code com um binário autônomo com menos de 10 mil linhas de código. O projeto inclui uma TUI com bubbletea, suporte a múltiplos provedores, cliente MCP e motor de execução de ferramentas.

Análise do Conselho LLM Revela Estratégias Práticas de Otimização de Tokens de Código Claude
Um desenvolvedor usou a ferramenta LLM Council com 5 personas para analisar padrões de uso do Claude Code, identificando que o modo de pensamento estendido por padrão era o maior consumidor de tokens. O playbook resultante alcançou redução de 60-70% nos tokens com mesma ou melhor qualidade de saída.

OpenClaw Integra Recursos do Vazamento de Código do Claude
Um usuário do OpenClaw fez seu bot analisar o código vazado do Claude (recriação em Rust por Instructkr) e portou seletivamente padrões arquiteturais específicos para sua configuração do OpenClaw. A integração foca em melhorias práticas como continuidade automática na inicialização, compactação de conversas e uma estrutura de ganchos pré-ferramenta/pós-ferramenta.

Sistema de memória de código aberto para agentes LLM alcança altas pontuações em benchmarks
Um sistema de memória persistente para Claude Code e OpenClaw fornece aos agentes LLM continuidade de contexto entre sessões, alcançando 90,8% no LoCoMo e 89,1% nos benchmarks LongMemEval. A arquitetura baseada em adaptadores funciona com qualquer framework de agentes.