2-Prompt-System zur Kontextübertragung zwischen Claude-Chats ohne Token-Verschwendung

Ein Reddit-Nutzer veröffentlichte ein praktisches System, um das Problem zu lösen, dass Claude während eines Projekts die Chat-Längenbeschränkung erreicht. Die Lösung verwendet zwei Prompts: einen zur Kontextextraktion aus dem alten Chat, einen weiteren zur Initialisierung im neuen Chat.
Das Problem
Lange Claude-Konversationen werden langsamer, erreichen Längenbeschränkungen oder werden auf der API teuer. Gängige Workarounds – manuelle Zusammenfassung, Kopieren und Einfügen ganzer Chats oder Neustarten – verlieren kritische Entscheidungen, verschwenden Tokens oder erfordern erneute Erklärungen.
Das System
Prompt 1: Kontextextraktion (im alten Chat einfügen)
Weist Claude an, die gesamte Konversation in eine strukturierte Zusammenfassung mit 9 Abschnitten zu komprimieren: Zielsetzung, Schlüsselkontext, getroffene Entscheidungen, abgeschlossene Arbeiten, aktueller Stand, nächste Schritte, offene Fragen/Blockaden, kritische Daten/Ressourcen sowie Stil & Präferenzen. Die Ausgabe muss in einem sauberen Codeblock erfolgen. Ziellänge: 300–600 Wörter, wobei Spezifika gegenüber Allgemeinheiten bevorzugt werden.
Prompt 2: Chat-Initialisierung (im neuen Chat einfügen)
Sie fügen den extrahierten Kontextblock ein und weisen den neuen Chat an, ihn als Quelle der Wahrheit zu behandeln. Claude wird gebeten, das Verständnis zu bestätigen, eventuelle Lücken zu kennzeichnen und von den nächsten Schritten fortzufahren, anstatt neu zu beginnen.
Die genauen Prompts sind in der Quelle angegeben. Die Ausgabestruktur des Extraktionsprompts verwendet beispielsweise folgende Überschriften:
- Zielsetzung
- Schlüsselkontext
- Getroffene Entscheidungen (mit Gründen)
- Abgeschlossene Arbeiten
- Aktueller Stand
- Nächste Schritte (unmittelbar nächsten mit → markieren)
- Offene Fragen / Blockaden
- Kritische Daten / Ressourcen
- Stil & Präferenzen
Der Initialisierungsprompt enthält: „Behandle den Kontext als etabliert. Formuliere nicht neu oder starte neu. Behalte alle genannten Entscheidungen und Präferenzen bei.“ und fordert eine Bestätigungsantwort mit Zielsetzung, unmittelbarer nächster Aktion und etwaigen Lücken.
Für wen es gedacht ist
Entwickler, die Claude (API oder Web) verwenden und langlaufende Projekte fortsetzen müssen, ohne den Kontext zu verlieren oder Tokens für redundante Erklärungen zu verschwenden.
📖 Vollständige Quelle lesen: r/ClaudeAI
👀 Siehe auch

Mehrschichtiges Verteidigungsrahmenwerk für die Durchsetzung von Claude-Code-Regeln
Ein IT-Operations-Experte entwickelte ein 8-Schichten-Verteidigungsframework, um Claude-Code-Regeln durchzusetzen, nachdem er feststellte, dass sowohl CLAUDE.md-Prompts als auch Blocking-Hooks umgangen werden können. Der Ansatz adaptiert das Schweizer-Käse-Modell aus der Unfalluntersuchung, um Workarounds zu verhindern.

ClaudeMeter: Open-Source macOS-Menüleisten-App zur Echtzeit-Verfolgung der Claude-Nutzung
ClaudeMeter ist eine kostenlose, Open-Source-macOS-Menüleisten-App für Claude Max-Abonnenten, die Sitzungs- und wöchentliche Nutzungsprozentsätze, Reset-Timer und Tempoanzeigen anzeigt, ohne den Arbeitsablauf zu unterbrechen. Die gesamte App wurde mit Claude (Claude Code/Opus) für Swift-Code, Supabase-Backend und Edge Functions erstellt.

Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-Modell mit LM Studio-Konfiguration veröffentlicht
Ein zusammengeführtes unzensiertes Modell, das die Qwen3.5-9B-Architektur mit Claude-4.6-Opus-Trainingsdaten kombiniert, ist jetzt verfügbar. Für optimale Leistung werden spezifische LM-Studio-0.4.7-Einstellungen bereitgestellt, einschließlich Temperatur 0.7 und Top-K-Sampling 20.

APEX-Testbenchmark-Ergebnisse: Qwen 3.5-Leistung bei echten Programmieraufgaben
APEX-Testing-Benchmark-Ergebnisse zeigen die Leistung der Qwen-3.5-Modelle bei 70 echten GitHub-Coding-Aufgaben, wobei die 397B-Version bei Master-Level-Aufgaben auf 1194 ELO abfällt, während GLM-4.7 quantisiert mit 1572 ELO die lokalen Modelle anführt.