Claude AI-Sitzungskomprimierungsprobleme und Workarounds

✍️ OpenClawRadar📅 Veröffentlicht: 17. März 2026🔗 Source
Claude AI-Sitzungskomprimierungsprobleme und Workarounds
Ad

Wie Komprimierung funktioniert

Claude-Sitzungen werden als JSONL-Dateien unter ~/.claude/projects/{encoded-cwd}/sessions/{id}.jsonl gespeichert. Jeder Gesprächsschritt ist ein JSON-Block. Wenn die Komprimierung ausgelöst wird, bleiben die ursprünglichen Blöcke in der Datei erhalten, aber ein neuer Block mit einer komprimierten Zusammenfassung wird angehängt. Nach der Komprimierung arbeitet das Modell mit der Zusammenfassung anstelle des vollständigen Gesprächsverlaufs.

Testergebnisse

Mit einem Codierungsprojekt bei 90 % Kontextfüllung (vor der Erhöhung auf 1 Million Tokens) testete der Benutzer 10 Fragen zu einfachem Abruf, 6-stufigen Abhängigkeitsketten, Entitätsdisambiguierung, Negationsverkettung, Abwesenheitserkennung und Konflikterkennung.

  • Vor der Komprimierung: ~9,75/10 Genauigkeit mit Opus 4.6, das verstreute Fakten über 418.000 Tokens fand
  • Nach der Komprimierung (Standard): ~5/10 Genauigkeit mit 3.461 Tokens (121-fache Komprimierung). Dieselbe Sitzung, dieselben Fragen führten zu halluzinierten falschen Antworten.
  • Nach der Komprimierung (Manuell mit Opus): ~9,75/10 Genauigkeit mit 6.080 Tokens (69-fache Komprimierung). Die Verwendung eines benutzerdefinierten Komprimierungsprompts mit Opus bewahrte wichtige Informationen.
Ad

Warum der Unterschied

Laut der Dokumentation von Anthropic verwendet die API standardmäßig dasselbe Modell für die Komprimierung. Der Benutzer lief Opus 4.6 auf mittlerer Rechenleistung, daher hätte die Standardkomprimierung ebenfalls Opus verwenden sollen. Der Qualitätsunterschied deutet auf Probleme mit dem Zusammenfassungsprompt, dem Denk-/Rechenbudget oder beidem hin.

Workarounds

Ansatz 1: Opus-Komprimierung – Automatische Komprimierung deaktivieren und einen Hintergrundprozess implementieren, der Token-Zählungen für Claude Code-Instanzen misst. Komprimierung mit Opus und einem benutzerdefinierten Prompt auslösen (möglicherweise mit Benutzerautorisierung).

Ansatz 2: spaCy NER-Vorausfüllung – Anstatt Sub-Agenten ohne Kontext zu starten, spaCy NER verwenden, um Eigennamen, Zahlen, Dienstnamen, Ports und Schlüsselidentifikatoren aus Projektdateien zu extrahieren. Dies als leichtgewichtige Entitäts-Einführung (wenige hundert Tokens) beim Start einspritzen, um Agenten über vorhandene Ressourcen zu informieren, ohne narrativen Ballast.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

osu-mcp: Ein MCP-Server, der Claude ermöglicht, deine osu!-Statistiken in einfachem Englisch zu analysieren
Werkzeuge

osu-mcp: Ein MCP-Server, der Claude ermöglicht, deine osu!-Statistiken in einfachem Englisch zu analysieren

osu-mcp ist ein MCP-Server für die osu! API v2, jetzt im offiziellen MCP Registry. Er stellt 12 Tools zur Verfügung: Spielerprofile, Score-Verlauf, Beatmap-Suche, Ranglisten und mehr. In einer Demo berechnete Claude die pp-pro-Play-Effizienz über mehrere Accounts hinweg und zeigte, dass das Volumen, nicht die Genauigkeit, der Engpass war.

OpenClawRadar
Tessera: Open-Source-GUI-Arbeitsbereich zur Verwaltung mehrerer Claude Code-Sitzungen
Werkzeuge

Tessera: Open-Source-GUI-Arbeitsbereich zur Verwaltung mehrerer Claude Code-Sitzungen

Tessera ist eine quelloffene GUI, mit der Sie mehrere Claude Code-Sitzungen parallel mit Git-Worktree-Isolation, Kanban-Aufgabenverfolgung, Live-Diffs und Agentenaktivitätsprüfung ausführen können.

OpenClawRadar
Savant Commander 48B: Ein benutzerdefiniertes Qwen 3 Mixture-of-Experts-Modell mit 12 destillierten Modellen
Werkzeuge

Savant Commander 48B: Ein benutzerdefiniertes Qwen 3 Mixture-of-Experts-Modell mit 12 destillierten Modellen

Savant Commander 48B ist ein benutzerdefiniertes Qwen 3 Mixture-of-Experts-Modell mit handkodiertem Routing, das 12 destillierte Modelle von Anbietern wie Claude, Gemini, OpenAI und Deepseek kombiniert. Es verfügt über eine Kontextlänge von 256K und ermöglicht die promptgesteuerte Aktivierung spezifischer destillierter Modelle.

OpenClawRadar
Stoppen Sie, Claude Code in jeder Sitzung neu zu unterrichten: Verwenden Sie eine persistente Konfiguration
Werkzeuge

Stoppen Sie, Claude Code in jeder Sitzung neu zu unterrichten: Verwenden Sie eine persistente Konfiguration

Ein Reddit-Benutzer erklärt, wie er durch das Schreiben einer persistenten Konfiguration für Claude Code 20 Minuten pro Sitzung sparte, wiederholtes Steuern eliminierte und 33 % schnellere Abschlüsse erreichte.

OpenClawRadar