Claude AI-Sitzungskomprimierungsprobleme und Workarounds

Wie Komprimierung funktioniert
Claude-Sitzungen werden als JSONL-Dateien unter ~/.claude/projects/{encoded-cwd}/sessions/{id}.jsonl gespeichert. Jeder Gesprächsschritt ist ein JSON-Block. Wenn die Komprimierung ausgelöst wird, bleiben die ursprünglichen Blöcke in der Datei erhalten, aber ein neuer Block mit einer komprimierten Zusammenfassung wird angehängt. Nach der Komprimierung arbeitet das Modell mit der Zusammenfassung anstelle des vollständigen Gesprächsverlaufs.
Testergebnisse
Mit einem Codierungsprojekt bei 90 % Kontextfüllung (vor der Erhöhung auf 1 Million Tokens) testete der Benutzer 10 Fragen zu einfachem Abruf, 6-stufigen Abhängigkeitsketten, Entitätsdisambiguierung, Negationsverkettung, Abwesenheitserkennung und Konflikterkennung.
- Vor der Komprimierung: ~9,75/10 Genauigkeit mit Opus 4.6, das verstreute Fakten über 418.000 Tokens fand
- Nach der Komprimierung (Standard): ~5/10 Genauigkeit mit 3.461 Tokens (121-fache Komprimierung). Dieselbe Sitzung, dieselben Fragen führten zu halluzinierten falschen Antworten.
- Nach der Komprimierung (Manuell mit Opus): ~9,75/10 Genauigkeit mit 6.080 Tokens (69-fache Komprimierung). Die Verwendung eines benutzerdefinierten Komprimierungsprompts mit Opus bewahrte wichtige Informationen.
Warum der Unterschied
Laut der Dokumentation von Anthropic verwendet die API standardmäßig dasselbe Modell für die Komprimierung. Der Benutzer lief Opus 4.6 auf mittlerer Rechenleistung, daher hätte die Standardkomprimierung ebenfalls Opus verwenden sollen. Der Qualitätsunterschied deutet auf Probleme mit dem Zusammenfassungsprompt, dem Denk-/Rechenbudget oder beidem hin.
Workarounds
Ansatz 1: Opus-Komprimierung – Automatische Komprimierung deaktivieren und einen Hintergrundprozess implementieren, der Token-Zählungen für Claude Code-Instanzen misst. Komprimierung mit Opus und einem benutzerdefinierten Prompt auslösen (möglicherweise mit Benutzerautorisierung).
Ansatz 2: spaCy NER-Vorausfüllung – Anstatt Sub-Agenten ohne Kontext zu starten, spaCy NER verwenden, um Eigennamen, Zahlen, Dienstnamen, Ports und Schlüsselidentifikatoren aus Projektdateien zu extrahieren. Dies als leichtgewichtige Entitäts-Einführung (wenige hundert Tokens) beim Start einspritzen, um Agenten über vorhandene Ressourcen zu informieren, ohne narrativen Ballast.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

mycrab.space stellt SKILL.md und Prompt Autocomposer für standardisierte App-Bereitstellung vor
mycrab.space hat SKILL.md veröffentlicht, eine Markdown-Vorlage zur Definition von App-Abhängigkeiten und Konfigurationen, sowie einen Prompt Autocomposer, der aus diesen Dateien einsatzbereite Bereitstellungsbefehle generiert. Das System ermöglicht die Null-Konfiguration-Bereitstellung von Anwendungen wie VS Code im Browser, persönlichen Musik-Clouds und KI-Agenten-Schnittstellen.

Proaktive Kontext-Rot-Erkennung in Claude Code: Ein Feature-Vorschlag von r/ClaudeAI
Ein Reddit-Feature-Vorschlag schlägt vor, dass Claude Code proaktiv Kontextverfall erkennt und eine strukturierte aufgabenbezogene Übergabe anbietet, wobei automatisch eine Übergabedatei erstellt und eine neue Sitzung gestartet wird.

Claude Banana: Ein Claude Code-Plugin für bildgenerierung mit Design-System-Bewusstsein
Claude Banana ist ein Claude Code-Plugin zur Bildgenerierung mit der Google Gemini API. Es erstellt kontextbewusste Prompts, indem es Tailwind-Konfigurationen, CSS-Variablen, Design-Tokens und bestehende Assets liest, um die visuellen Stile eines Projekts zu verstehen.

Claude Code Auto-Modus: Eine sicherere Alternative zum Überspringen von Berechtigungen
Claude Code bietet jetzt den Automodus, einen Berechtigungsmodus, in dem Claude Berechtigungsentscheidungen trifft, während Sicherheitsvorkehrungen Aktionen vor der Ausführung überwachen. Er ist als Forschungsvorschau für Team-Plan-Nutzer verfügbar, mit einer Veröffentlichung für Enterprise und API in Kürze.