Recuperação: Memória Local de Projetos para Claude Code — Sem Gasto de Tokens em Resumos

✍️ OpenClawRadar📅 Publicado: June 22, 2026🔗 Source
Recuperação: Memória Local de Projetos para Claude Code — Sem Gasto de Tokens em Resumos
Ad

Recall é um plugin de memória de projeto totalmente local para Claude Code que resolve o problema de inicialização a frio sem gastar tokens de modelo em sumarização. Ele captura transcrições de sessão em .recall/history.md e as condensa em um context.md compacto (~1–2K tokens) usando um sumarizador Python clássico — não uma chamada de LLM.

Como Funciona

  • Durante uma sessão: Os hooks Stop / SessionEnd adicionam nova atividade incrementalmente a .recall/history.md — apenas novas interações, totalmente local.
  • No início da sessão: O hook SessionStart exibe context.md e solicita que Claude confirme: retomar do contexto salvo? e continuar registrando esta sessão?

Principais Vantagens

  • Gasto zero de tokens em memória: A sumarização é feita localmente por um algoritmo determinístico, não por uma chamada de API. Nenhuma chave de API ou modelo externo é necessário.
  • Privacidade: As transcrições (código, caminhos, segredos) nunca saem da sua máquina. A maioria das ferramentas de memória envia o contexto para um endpoint de modelo; o Recall não.
  • Baixo atrito: Sem pip install, sem modelo local para executar, sem configurar chave — funciona offline imediatamente ao carregar o plugin.
Ad

Arquivos de Saída

Dois arquivos em .recall/:

  • history.md — registro somente de anexação de prompts, respostas, arquivos tocados, comandos executados.
  • context.md — resumo sobrescrito contendo: objetivo, resumo, próximos passos/tópicos abertos, arquivos tocados, onde parou.

Comparação com a Memória Integrada do Claude Code

RecursoCLAUDE.md--continue / --resumeRecall
O que éNotas e regras escritas à mãoRecarrega uma conversa anteriorRegistro de sessão capturado automaticamente + resumo local
ManutençãoManualNenhuma (você escolhe a sessão)Nenhuma — escrito enquanto você trabalha
ContémInstruções a seguirTranscrição anterior completaObjetivo, arquivos, comandos, onde parou, próximos passos
Custo para retomarPequenoGrande (reproduz transcrição completa)~1–2K tokens (resumo compacto)
FormaMarkdown que você editaEstado de sessão localTexto simples em .recall/ — passível de diff e compartilhável
Claude trata comoInstruçõesA conversaDados de referência não confiáveis isolados

Em resumo: CLAUDE.md é como quero que você trabalhe; Recall é aqui está o que fizemos da última vez e onde paramos — produzido offline sem gastar tokens de modelo.

📖 Leia a fonte completa: HN LLM Tools

Ad

👀 See Also

Revisão de Desempenho do Omnicoder-9B: Velocidade vs. Problemas de Chamada de Ferramentas
Tools

Revisão de Desempenho do Omnicoder-9B: Velocidade vs. Problemas de Chamada de Ferramentas

Omnicoder-9B, um modelo focado em programação ajustado no Qwen3.5 9B com saídas do Opus 4.6, GPT 5.4, GPT 5.3 Codex e Gemini 3.1 Pro, mostra desempenho forte em hardware de médio porte, mas tem problemas de chamada de ferramentas em IDEs.

OpenClawRadar
Android CLI e Habilidades para Fluxos de Trabalho de Desenvolvimento de Agentes de IA
Tools

Android CLI e Habilidades para Fluxos de Trabalho de Desenvolvimento de Agentes de IA

O Google lançou o Android CLI com comandos como android create e android sdk install, além do repositório GitHub Android Skills com conjuntos de instruções modulares. Benchmarks internos mostram redução de 70% no uso de tokens LLM e conclusão de tarefas 3x mais rápida.

OpenClawRadar
Escalonando a Autopesquisa de Karpathy com 16 GPUs: Resultados e Métodos
Tools

Escalonando a Autopesquisa de Karpathy com 16 GPUs: Resultados e Métodos

A equipe SkyPilot deu ao Claude Code acesso a 16 GPUs em um cluster Kubernetes para executar o projeto Autoresearch de Karpathy. Ao longo de 8 horas, o agente submeteu cerca de 910 experimentos, reduziu os bits por byte de validação de 1,003 para 0,974 (melhoria de 2,87%) e alcançou a melhor perda de validação 9 vezes mais rápido do que a execução sequencial.

OpenClawRadar
Arquitetura de Validação Fria: Sistema de Revisão de Código com Agente Duplo em Código Aberto
Tools

Arquitetura de Validação Fria: Sistema de Revisão de Código com Agente Duplo em Código Aberto

Sistema de código aberto utiliza dois agentes de IA separados para validação de código: um constrói o código, outro o revisa sem nenhum contexto sobre o raciocínio do construtor. O revisor vê apenas documentos de planejamento, diferenças de código e saídas de teste.

OpenClawRadar