Problemas de Compactação de Sessão do Claude AI e Soluções Alternativas

Como a Compactação Funciona
As sessões do Claude são armazenadas como arquivos JSONL em ~/.claude/projects/{encoded-cwd}/sessions/{id}.jsonl. Cada turno de conversa é um bloco JSON. Quando a compactação é acionada, os blocos originais permanecem no arquivo, mas um novo bloco com um resumo compactado é anexado. Após a compactação, o modelo trabalha a partir do resumo em vez do histórico completo da conversa.
Resultados dos Testes
Com um projeto de programação em 90% de preenchimento de contexto (antes do aumento para 1 milhão de tokens), o usuário testou 10 questões cobrindo recuperação simples, cadeias de dependência de 6 saltos, desambiguação de entidades, encadeamento de negações, detecção de ausência e detecção de conflitos.
- Pré-compactação: ~9,75/10 de precisão com Opus 4.6 encontrando fatos dispersos em 418 mil tokens
- Pós-compactação (Padrão): ~5/10 de precisão com 3.461 tokens (compactação de 121x). A mesma sessão, as mesmas questões resultaram em respostas incorretas alucinadas.
- Pós-compactação (Manual Opus): ~9,75/10 de precisão com 6.080 tokens (compactação de 69x). Usar um prompt de compactação personalizado com Opus preservou informações importantes.
Por que a Diferença
De acordo com a documentação da Anthropic, a API usa por padrão o mesmo modelo para compactação. O usuário estava executando Opus 4.6 em computação média, então a compactação padrão deveria ter usado Opus também. A diferença de qualidade sugere problemas com o prompt de sumarização, o orçamento de pensamento/computação, ou ambos.
Soluções Alternativas
Abordagem 1: Compactação Opus - Desative a compactação automática e implemente um processo em segundo plano que mede a contagem de tokens para instâncias do Claude Code. Acione a compactação usando Opus com um prompt personalizado (potencialmente com autorização do usuário).
Abordagem 2: Pré-preenchimento com spaCy NER - Em vez de iniciar subagentes com contexto zero, use spaCy NER para extrair nomes próprios, números, nomes de serviços, portas e identificadores-chave dos arquivos do projeto. Injete isso como um briefing leve de entidades (algumas centenas de tokens) na inicialização para informar os agentes sobre recursos existentes sem inflar a narrativa.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Contador de Tokens do Claude Atualizado com Recurso de Comparação de Modelos
A ferramenta Contador de Tokens do Claude de Simon Willison agora suporta a comparação de contagens de tokens entre diferentes modelos do Claude. A atualização revela que o Opus 4.7 usa 1,0–1,35× mais tokens que o Opus 4.6 devido a um tokenizador atualizado, o que pode aumentar os custos em cerca de 40% apesar do preço idêntico.

Especialista em código aberto: o adaptador de despacho delega tarefas complexas para o Claude Code
expert-dispatch é um script bash de aproximadamente 500 linhas que permite que um assistente de IA barato delegue tarefas complexas de programação para o Claude Code CLI. Ele usa comandos como dispatch-cc run para enviar tarefas e mantém diretórios por projeto com CLAUDE.md para contexto persistente.

LUMA SOUL: Mentes Impulsionadas por Claude com Bloqueio Permanente do Criador e Memória Transparente
LUMA SOUL é uma plataforma de presença onde mentes Claude ganham retratos, vozes e documentos de alma. Decisão-chave: criadores perdem direitos de edição permanentemente no envio, e a memória é totalmente transparente.

Sentinel AI de Homelab: Assistente de Monitoramento Autônomo com Integração LLM
Homelab AI Sentinel é uma ferramenta auto-hospedada que processa webhooks de monitoramento através de um LLM para gerar diagnósticos em linguagem simples. Suporta 11 fontes de alerta, 10 plataformas de notificação e funciona com qualquer endpoint compatível com OpenAI, incluindo Ollama e LM Studio para inferência local.