Arquitetura de Memória do Vektori: Princípios do Sistema Vazado do Claude

✍️ OpenClawRadar📅 Publicado: April 15, 2026🔗 Source
Arquitetura de Memória do Vektori: Princípios do Sistema Vazado do Claude
Ad

Princípios da Arquitetura de Memória

A equipe do Claude Code compartilhou como seu sistema de memória funciona, revelando princípios-chave: a memória é um índice, não um armazenamento. O MEMORY.md contém apenas ponteiros (150 caracteres por linha), com o conhecimento real em arquivos separados buscados sob demanda. Transcrições brutas nunca são carregadas—apenas pesquisadas (grepped) quando necessário. Existem três camadas, cada uma com custos de acesso diferentes. O princípio mais agudo: se algo é derivável, não o armazene. A recuperação é cética—a memória é uma pista, não a verdade, e o modelo verifica antes de usar.

Implementação do Vektori

O Vektori aplica os mesmos princípios com uma forma diferente. Enquanto o Claude usa uma hierarquia de arquivos, o Vektori implementa um grafo hierárquico de sentenças com três camadas:

  • CAMADA DE FATOS (L0) — Declarações precisas que servem como superfície de busca. Barata e sempre consultável.
  • CAMADA DE EPISÓDIOS (L1) — Episódios entre conversas, descobertos automaticamente.
  • CAMADA DE SENTENÇAS (L2) — Conversa bruta, buscada apenas quando explicitamente necessário.

O mesmo modelo de acesso se aplica: L0 é seu índice, L2 é sua transcrição (pesquisada, não despejada). Você paga pelo que precisa.

Disciplina Rigorosa de Escrita

Nada entra na L0 sem passar por filtros de qualidade: contagem mínima de caracteres, verificação de densidade de conteúdo, proporção de pronomes. Se uma sentença for muito vaga ou puramente preenchimento, ela nunca se torna um fato. Isso corresponde ao princípio do Claude de não armazenar coisas deriváveis.

Ad

Mecânica de Recuperação

A recuperação funciona como o Claude descreve: pontuada, limitada por um limiar, cética. Pontuação mínima de 0,3 antes que qualquer coisa surja. Os resultados são classificados por similaridade vetorial mais decaimento temporal, não recuperados cegamente.

Divergência Arquitetônica sobre Correções

A abordagem do Claude otimiza para contextos de projeto de usuário único, onde o estado mais recente importa. O Vektori, projetado para agentes trabalhando em centenas de sessões, preserva o histórico de correções. Quando um usuário muda de ideia, o fato antigo permanece no grafo com seus links de sentença, permitindo rastrear o que foi dito antes da mudança e por que foi substituído.

Desempenho e Futuro

No LongMemEval-S, o Vektori alcançou 73% de precisão na profundidade L1 usando BGE-M3 + Gemini Flash-2.5-lite. A resolução de conflitos de múltiplos saltos—onde você raciocina sobre como um fato mudou ao longo do tempo—é onde os sistemas baseados em triplos (sujeito-objeto-predicado) colapsam. A próxima camada envolve armazenar o porquê: arestas causais entre eventos ("usuário corrigiu X, agente atualizou Y, usuário contestou novamente") extraídas de forma assíncrona e consultáveis como um grafo. As trajetórias do agente se tornam memória—o próprio comportamento do agente se torna parte do que ele pode raciocinar.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

Graph Compose: Fluxos de Trabalho Temporais Hospedados com Construtor Visual e IA
Tools

Graph Compose: Fluxos de Trabalho Temporais Hospedados com Construtor Visual e IA

Graph Compose é uma plataforma hospedada para orquestrar fluxos de trabalho de API no Temporal, permitindo que você defina fluxos de trabalho como gráficos JSON com três métodos de construção: um construtor visual React Flow, um SDK TypeScript e um assistente de IA que converte inglês simples em gráficos.

OpenClawRadar
Ferramenta de Limite de Aprovação para Trabalho no Repositório de Código Claude
Tools

Ferramenta de Limite de Aprovação para Trabalho no Repositório de Código Claude

Um desenvolvedor criou uma ferramenta de limite de aprovação que adiciona uma etapa de revisão antes da execução local ao usar o Claude Code para trabalhos em repositório. A ferramenta segue um ciclo: veja o plano primeiro, aprove uma vez, deixe a execução acontecer localmente e mantenha a prova depois.

OpenClawRadar
NPCterm: Emulador de Terminal PTY Completo para Agentes de IA via MCP
Tools

NPCterm: Emulador de Terminal PTY Completo para Agentes de IA via MCP

O NPCterm fornece aos agentes de IA acesso completo ao terminal através de um emulador de terminal PTY headless em memória exposto via MCP. Inclui 15 ferramentas MCP para controle de terminal, detecção de estado de processos e suporte para aplicações TUI.

OpenClawRadar
GLM-5-Turbo Apresenta Baixa Taxa de Erro em Chamadas de Ferramentas em Testes com Usuários
Tools

GLM-5-Turbo Apresenta Baixa Taxa de Erro em Chamadas de Ferramentas em Testes com Usuários

O modelo z-ai/glm-5-turbo demonstra uma taxa média de erro em chamadas de ferramentas de 0,57% em testes, significativamente menor que a taxa de ~3% do GLM-5. Um usuário relatou ter usado com sucesso uma ferramenta CLI para escrever um romance de fantasia de 97.000 palavras com problemas mínimos.

OpenClawRadar