2-Prompt-System zur Kontextübertragung zwischen Claude-Chats ohne Token-Verschwendung

✍️ OpenClawRadar📅 Veröffentlicht: 6. Mai 2026🔗 Source
2-Prompt-System zur Kontextübertragung zwischen Claude-Chats ohne Token-Verschwendung
Ad

Ein Reddit-Nutzer veröffentlichte ein praktisches System, um das Problem zu lösen, dass Claude während eines Projekts die Chat-Längenbeschränkung erreicht. Die Lösung verwendet zwei Prompts: einen zur Kontextextraktion aus dem alten Chat, einen weiteren zur Initialisierung im neuen Chat.

Das Problem

Lange Claude-Konversationen werden langsamer, erreichen Längenbeschränkungen oder werden auf der API teuer. Gängige Workarounds – manuelle Zusammenfassung, Kopieren und Einfügen ganzer Chats oder Neustarten – verlieren kritische Entscheidungen, verschwenden Tokens oder erfordern erneute Erklärungen.

Ad

Das System

Prompt 1: Kontextextraktion (im alten Chat einfügen)
Weist Claude an, die gesamte Konversation in eine strukturierte Zusammenfassung mit 9 Abschnitten zu komprimieren: Zielsetzung, Schlüsselkontext, getroffene Entscheidungen, abgeschlossene Arbeiten, aktueller Stand, nächste Schritte, offene Fragen/Blockaden, kritische Daten/Ressourcen sowie Stil & Präferenzen. Die Ausgabe muss in einem sauberen Codeblock erfolgen. Ziellänge: 300–600 Wörter, wobei Spezifika gegenüber Allgemeinheiten bevorzugt werden.

Prompt 2: Chat-Initialisierung (im neuen Chat einfügen)
Sie fügen den extrahierten Kontextblock ein und weisen den neuen Chat an, ihn als Quelle der Wahrheit zu behandeln. Claude wird gebeten, das Verständnis zu bestätigen, eventuelle Lücken zu kennzeichnen und von den nächsten Schritten fortzufahren, anstatt neu zu beginnen.

Die genauen Prompts sind in der Quelle angegeben. Die Ausgabestruktur des Extraktionsprompts verwendet beispielsweise folgende Überschriften:

  1. Zielsetzung
  2. Schlüsselkontext
  3. Getroffene Entscheidungen (mit Gründen)
  4. Abgeschlossene Arbeiten
  5. Aktueller Stand
  6. Nächste Schritte (unmittelbar nächsten mit → markieren)
  7. Offene Fragen / Blockaden
  8. Kritische Daten / Ressourcen
  9. Stil & Präferenzen

Der Initialisierungsprompt enthält: „Behandle den Kontext als etabliert. Formuliere nicht neu oder starte neu. Behalte alle genannten Entscheidungen und Präferenzen bei.“ und fordert eine Bestätigungsantwort mit Zielsetzung, unmittelbarer nächster Aktion und etwaigen Lücken.

Für wen es gedacht ist

Entwickler, die Claude (API oder Web) verwenden und langlaufende Projekte fortsetzen müssen, ohne den Kontext zu verlieren oder Tokens für redundante Erklärungen zu verschwenden.

📖 Vollständige Quelle lesen: r/ClaudeAI

Ad

👀 Siehe auch

Mehrschichtiges Verteidigungsrahmenwerk für die Durchsetzung von Claude-Code-Regeln
Werkzeuge

Mehrschichtiges Verteidigungsrahmenwerk für die Durchsetzung von Claude-Code-Regeln

Ein IT-Operations-Experte entwickelte ein 8-Schichten-Verteidigungsframework, um Claude-Code-Regeln durchzusetzen, nachdem er feststellte, dass sowohl CLAUDE.md-Prompts als auch Blocking-Hooks umgangen werden können. Der Ansatz adaptiert das Schweizer-Käse-Modell aus der Unfalluntersuchung, um Workarounds zu verhindern.

OpenClawRadar
ClaudeMeter: Open-Source macOS-Menüleisten-App zur Echtzeit-Verfolgung der Claude-Nutzung
Werkzeuge

ClaudeMeter: Open-Source macOS-Menüleisten-App zur Echtzeit-Verfolgung der Claude-Nutzung

ClaudeMeter ist eine kostenlose, Open-Source-macOS-Menüleisten-App für Claude Max-Abonnenten, die Sitzungs- und wöchentliche Nutzungsprozentsätze, Reset-Timer und Tempoanzeigen anzeigt, ohne den Arbeitsablauf zu unterbrechen. Die gesamte App wurde mit Claude (Claude Code/Opus) für Swift-Code, Supabase-Backend und Edge Functions erstellt.

OpenClawRadar
Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-Modell mit LM Studio-Konfiguration veröffentlicht
Werkzeuge

Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-Modell mit LM Studio-Konfiguration veröffentlicht

Ein zusammengeführtes unzensiertes Modell, das die Qwen3.5-9B-Architektur mit Claude-4.6-Opus-Trainingsdaten kombiniert, ist jetzt verfügbar. Für optimale Leistung werden spezifische LM-Studio-0.4.7-Einstellungen bereitgestellt, einschließlich Temperatur 0.7 und Top-K-Sampling 20.

OpenClawRadar
APEX-Testbenchmark-Ergebnisse: Qwen 3.5-Leistung bei echten Programmieraufgaben
Werkzeuge

APEX-Testbenchmark-Ergebnisse: Qwen 3.5-Leistung bei echten Programmieraufgaben

APEX-Testing-Benchmark-Ergebnisse zeigen die Leistung der Qwen-3.5-Modelle bei 70 echten GitHub-Coding-Aufgaben, wobei die 397B-Version bei Master-Level-Aufgaben auf 1194 ELO abfällt, während GLM-4.7 quantisiert mit 1572 ELO die lokalen Modelle anführt.

OpenClawRadar