Recuperação: Memória Local de Projetos para Claude Code — Sem Gasto de Tokens em Resumos

Recall é um plugin de memória de projeto totalmente local para Claude Code que resolve o problema de inicialização a frio sem gastar tokens de modelo em sumarização. Ele captura transcrições de sessão em .recall/history.md e as condensa em um context.md compacto (~1–2K tokens) usando um sumarizador Python clássico — não uma chamada de LLM.
Como Funciona
- Durante uma sessão: Os hooks
Stop/SessionEndadicionam nova atividade incrementalmente a.recall/history.md— apenas novas interações, totalmente local. - No início da sessão: O hook
SessionStartexibecontext.mde solicita que Claude confirme: retomar do contexto salvo? e continuar registrando esta sessão?
Principais Vantagens
- Gasto zero de tokens em memória: A sumarização é feita localmente por um algoritmo determinístico, não por uma chamada de API. Nenhuma chave de API ou modelo externo é necessário.
- Privacidade: As transcrições (código, caminhos, segredos) nunca saem da sua máquina. A maioria das ferramentas de memória envia o contexto para um endpoint de modelo; o Recall não.
- Baixo atrito: Sem
pip install, sem modelo local para executar, sem configurar chave — funciona offline imediatamente ao carregar o plugin.
Arquivos de Saída
Dois arquivos em .recall/:
history.md— registro somente de anexação de prompts, respostas, arquivos tocados, comandos executados.context.md— resumo sobrescrito contendo: objetivo, resumo, próximos passos/tópicos abertos, arquivos tocados, onde parou.
Comparação com a Memória Integrada do Claude Code
| Recurso | CLAUDE.md | --continue / --resume | Recall |
|---|---|---|---|
| O que é | Notas e regras escritas à mão | Recarrega uma conversa anterior | Registro de sessão capturado automaticamente + resumo local |
| Manutenção | Manual | Nenhuma (você escolhe a sessão) | Nenhuma — escrito enquanto você trabalha |
| Contém | Instruções a seguir | Transcrição anterior completa | Objetivo, arquivos, comandos, onde parou, próximos passos |
| Custo para retomar | Pequeno | Grande (reproduz transcrição completa) | ~1–2K tokens (resumo compacto) |
| Forma | Markdown que você edita | Estado de sessão local | Texto simples em .recall/ — passível de diff e compartilhável |
| Claude trata como | Instruções | A conversa | Dados de referência não confiáveis isolados |
Em resumo: CLAUDE.md é como quero que você trabalhe; Recall é aqui está o que fizemos da última vez e onde paramos — produzido offline sem gastar tokens de modelo.
📖 Leia a fonte completa: HN LLM Tools
👀 See Also

Revisão de Desempenho do Omnicoder-9B: Velocidade vs. Problemas de Chamada de Ferramentas
Omnicoder-9B, um modelo focado em programação ajustado no Qwen3.5 9B com saídas do Opus 4.6, GPT 5.4, GPT 5.3 Codex e Gemini 3.1 Pro, mostra desempenho forte em hardware de médio porte, mas tem problemas de chamada de ferramentas em IDEs.

Android CLI e Habilidades para Fluxos de Trabalho de Desenvolvimento de Agentes de IA
O Google lançou o Android CLI com comandos como android create e android sdk install, além do repositório GitHub Android Skills com conjuntos de instruções modulares. Benchmarks internos mostram redução de 70% no uso de tokens LLM e conclusão de tarefas 3x mais rápida.

Escalonando a Autopesquisa de Karpathy com 16 GPUs: Resultados e Métodos
A equipe SkyPilot deu ao Claude Code acesso a 16 GPUs em um cluster Kubernetes para executar o projeto Autoresearch de Karpathy. Ao longo de 8 horas, o agente submeteu cerca de 910 experimentos, reduziu os bits por byte de validação de 1,003 para 0,974 (melhoria de 2,87%) e alcançou a melhor perda de validação 9 vezes mais rápido do que a execução sequencial.

Arquitetura de Validação Fria: Sistema de Revisão de Código com Agente Duplo em Código Aberto
Sistema de código aberto utiliza dois agentes de IA separados para validação de código: um constrói o código, outro o revisa sem nenhum contexto sobre o raciocínio do construtor. O revisor vê apenas documentos de planejamento, diferenças de código e saídas de teste.