Gerenciando Contexto de IA com um Armazenamento de Conhecimento SQLite e Ferramentas MCP

✍️ OpenClawRadar📅 Publicado: May 14, 2026🔗 Source
Gerenciando Contexto de IA com um Armazenamento de Conhecimento SQLite e Ferramentas MCP
Ad

Um ponto problemático comum com agentes de codificação de IA: os arquivos CLAUDE.md crescem para milhares de linhas, consumindo orçamento de contexto e fazendo com que a IA ignore metade das regras de qualquer maneira. Um desenvolvedor no r/ClaudeAI construiu um sistema para resolver isso — RunawayContext (licenciado sob MIT, atualmente usado para integrações de gestão de construção na Vista, Procore, Monday.com, etc.).

Arquitetura

A ideia central: mover conhecimento profundo de um arquivo markdown simples para um banco de dados SQLite com busca em texto completo (FTS5) e busca vetorial opcional via sqlite-vec. Em vez de carregar tudo a cada sessão, apenas um pequeno resumo por projeto (~150 linhas), uma constituição global (~200 linhas) e uma "memória viva" baseada em ponteiros (~50 linhas) são carregados antecipadamente. A IA consulta o banco de dados sob demanda usando ferramentas MCP como search_lessons e get_chunk.

Ad

Detalhes Chave de Implementação

  • Matemática de tokens: O equivalente a ~280K tokens ainda existe — eles estão apenas no banco de dados, não carregados no contexto. A IA puxa o que precisa no meio da tarefa.
  • Limites fixos em código: O regenerador recusa escrever um resumo que ultrapasse seu limite de 150 linhas. 15 regras arquiteturais nomeadas têm testes de CI associados que falham na build se a regra se desviar.
  • Recuperação híbrida: A busca apenas vetorial foi pior que a híbrida. O sistema combina pontuações de palavras-chave FTS5 com pontuações vetoriais do sqlite-vec para obter melhores resultados.
  • Humano no loop: A IA escreve novas lições em uma caixa de entrada de rascunhos. Um humano deve aprovar antes da promoção para o repositório de conhecimento, evitando ruído.
  • Voz preservada: Os resumos gerados automaticamente contêm um bloco curado manualmente, delimitado por marcadores <!-- PRESERVE_START -->. O regenerador mantém essa seção intacta enquanto regenera tudo ao redor.

Lições Aprendidas

  • Imponha regras em código, não em política — toda instrução de "cuidado para não crescer" foi violada em poucos meses.
  • A recuperação híbrida FTS5 + vetorial supera a busca apenas vetorial.
  • Escritas diretas da IA no repositório de conhecimento introduzem ruído; use uma caixa de entrada de rascunhos com aprovação manual.

O sistema é agnóstico em relação ao agente e o repositório é público para qualquer um adaptar.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

Claude 4.6 Opus Raciocínio Destilado para 14GB para Apple Silicon via Quantização MLX
Tools

Claude 4.6 Opus Raciocínio Destilado para 14GB para Apple Silicon via Quantização MLX

Um desenvolvedor quantizou um modelo Qwen 3.5 27B destilado a partir de trajetórias de raciocínio do Claude 4.6 Opus, reduzindo-o de 55,6GB para 14GB usando MLX para Apple Silicon, alcançando ~16 tokens/seg em um M4 Pro enquanto mantém as capacidades de raciocínio analítico do modelo.

OpenClawRadar
Script e Fluxo de Trabalho de Fusão de Modelos GGUF para Variantes do Qwen3.5-35B
Tools

Script e Fluxo de Trabalho de Fusão de Modelos GGUF para Variantes do Qwen3.5-35B

Um usuário do Reddit compartilhou um script Python para mesclar arquivos de modelo GGUF com perda mínima, especificamente combinando o modelo Qwen3.5-35B-A3B-Uncensored do HauhauCS com a versão Claude-4.6-Opus-Reasoning-Distilled do samuelcardillo. O script roda no Google Colab Free Tier e inclui suporte à quantização via llama-quantize.

OpenClawRadar
Agent Forge: Ferramenta de Código Aberto Estrutura Pipelines de Múltiplos Agentes para Claude Code
Tools

Agent Forge: Ferramenta de Código Aberto Estrutura Pipelines de Múltiplos Agentes para Claude Code

Agent Forge é uma habilidade do Claude Code que gera pipelines completos de múltiplos agentes a partir de descrições de casos de uso. Ele cria arquivos de prompt, scripts de orquestração, diretórios de fluxo de dados e configurações do GitHub Actions com base em padrões observados em sistemas de múltiplos agentes existentes.

OpenClawRadar
🦀
Tools

Fork do OpenClaw com um LLM Personalizado: Um Guia de Configuração Somente Local

Um usuário do Reddit fez um fork do OpenClaw para rodar inteiramente em modelos locais, criando um 'JARVIS' totalmente personalizado, sem dependência de nuvem. O processo levou minutos, não horas, e roda duas versões lado a lado em um M2 Ultra.

OpenClawRadar