Claude Code registra cada sessão em disco — Veja como indexá-las e recuperá-las

Claude Code escreve um log JSONL apenas de adição de cada sessão em ~/.claude/projects/ desde o primeiro dia. Cada linha é um objeto JSON estruturado — função, timestamp, conteúdo, chamadas de ferramentas — formando um registro episódico completo que remonta à sua primeira sessão. Um usuário encontrou 1.026 sessões totalizando 57MB e 76.000 turnos, todos no disco sem uma forma integrada de consultá-los.
Construindo uma Camada de Recall
A solução é um indexador open-source (continuity-v2, MIT) que ingere esses logs no SQLite+FTS5 com arestas temporais entre turnos, além de um servidor MCP. De dentro de qualquer sessão do Claude Code, agora você pode executar:
search_sessions("lembra quando corrigimos aquele bug de autenticação no mês passado")
recall_session("a8f2c441")
thread_recall(root_id, depth=8)A função thread_recall realiza uma travessia BFS pelo grafo de arestas temporais para reconstruir uma thread entre fronteiras de sessão. O indexador também suporta importar conversations.json da exportação de dados do claude.ai, para que o histórico de chat web resida no mesmo índice que as sessões de CLI.
Corrigindo o Hard Reset da Compactação
A compactação é acionada quando o contexto fica cheio, mas o transcript_path no payload PreCompact nem sempre é preenchido no momento do hook. A correção: escrever um checkpoint a cada turno (não apenas no final da sessão) para que PreCompact sempre tenha dados frescos para fallback. Então SessionStart lê o campo source — "compact" significa que a compactação foi acionada, "resume" significa reinicialização do app, "startup" é uma nova sessão, "clear" é intencional. Cada um recebe comportamento diferente. Resultado líquido: a compactação se torna uma falta de cache, não um hard reset.
Discussão & Projetos Semelhantes
Acompanhe a discussão em andamento em anthropics/claude-code#47023. Sete projetos independentes de memória (Bella, NEXO Brain, Cozempic, world-model-mcp, etc.) todos chegaram independentemente aos mesmos requisitos. Uma especificação formal de hook está sendo elaborada lá.
Os hooks levam cerca de cinco minutos para configurar; o servidor MCP é um único arquivo Python. O repositório é licenciado sob MIT.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Análise dos Componentes Reutilizáveis em Go do Ollama para Desenvolvimento Local de LLM
Um desenvolvedor examinou o código-fonte do Ollama e encontrou vários componentes independentes em Go, incluindo um amostrador de tokens puro em Go, leitor/gravador GGUF, ferramentas de conversão de modelos, renderização de templates de chat e transformações de compatibilidade com OpenAI que não estão disponíveis como bibliotecas separadas.

Desenvolvedor Testa Qwen3.5 27B em Comparação com Modelos Maiores para Tarefas Locais de Programação
Um desenvolvedor testou vários modelos Qwen3.5 e Nemotron, descobrindo que o Qwen3.5-27B-GGUF:UD-Q6_K_XL tem bom desempenho para tarefas de desenvolvimento no hardware existente de 2x RTX 3090, com 803 pp e 25 tg/s em contexto de 256k no vast.ai.

ARP: Retransmissão WebSocket sem Estado para Comunicação de Agentes Autônomos
ARP (Agent Relay Protocol) é um retransmissor WebSocket sem estado para comunicação entre agentes autônomos, apresentando identidade Ed25519, criptografia HPKE conforme RFC 9180, enquadramento binário TLV e 33 bytes de sobrecarga por mensagem. Nenhuma conta ou registro necessário—basta gerar um par de chaves e conectar.

memora: Memória Versionada e Tipada para Agentes de IA – Git para Crenças de IA
memora é uma ferramenta CLI escrita em Rust que versiona a memória de agentes de IA com capacidades de tipagem, rastreamento de proveniência, ramificação e mesclagem.