Tipps zur Token-Nutzung für Claude Code

Ein detaillierter Reddit-Beitrag teilt hart erlernte Lektionen zum Umgang mit dem Token-Verbrauch in Claude Code. Der Autor stellt fest, dass der meiste Token-Verbrauch durch den Setup-Kontext entsteht, nicht durch Claudes Antworten. Hier sind die wichtigsten Praktiken, die er anwendet und empfiehlt:
Sofortige Erfolge
- Neue Chats für unzusammenhängende Aufgaben beginnen. Jede Nachricht in einer langen Unterhaltung sendet die gesamte Historie erneut. Ein Thread mit 40 Nachrichten verbraucht Tokens für Kontext, den Sie vor 20 Nachrichten nicht mehr interessiert hat.
- Kleine Fragen in einer Nachricht bündeln. Drei schnelle Rückfragen einzeln zu senden bedeutet drei vollständige Kontextladungen. Kombinieren Sie sie, um Overhead zu reduzieren.
CLAUDE.mdkurz halten und als Index verwenden. Alles hineinzuschreiben führt dazu, dass Claude es bei jedem Durchlauf erneut liest. Verweisen Sie stattdessen auf separate Dateien, sodass nur relevanter Kontext geladen wird.
Fortlaufende Gewohnheiten
- Präzise Dateiverweise verwenden. Anstatt zu sagen 'Hier ist die gesamte Codebasis, finde es heraus', was 30–50.000 Tokens für Erkundungen kosten kann, weisen Sie Claude auf die spezifische Funktion oder das Modul hin, das relevant ist.
- Nach 15–20 Nachrichten zusammenfassen und neu starten. Bitten Sie Claude um eine kurze Zusammenfassung und fügen Sie sie in einen neuen Thread ein. So wird toter Kontext entfernt, ohne den Fortschritt zu verlieren.
- Leichtere Modelle für leichtere Arbeiten verwenden. Entwürfe, Umformatierungen, Erklärungen – leiten Sie diese an kleinere Modelle weiter. Reservieren Sie das schwere Modell für aufwändige Denkaufgaben.
Der Beitrag lädt die Community ein, eigene Tricks zur Kontrolle des Token-Verbrauchs zu teilen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Wie man die Claude-Limits vermeidet: Behandle jede Sitzung wie ein Token-Budget
Ein Nutzer zeigt, wie er tägliche Claude-Limits umgeht, indem er Nachrichtenbloat vermeidet – Aufgaben eingenzen, nur relevanten Kontext laden, nach jeder Sitzung löschen. Inklusive praktischem Workflow und Infografik.

OpenClaw Discord-Proxy-Fix für REST-API-Timeout-Probleme
Ein Benutzer berichtet, dass er Verbindungsprobleme mit OpenClaw Discord behoben hat, bei denen sich WebSocket verbindet, aber REST-API-Aufrufe mit "fetch failed UND_ERR_CONNECT_TIMEOUT"-Fehlern fehlschlagen. Die Lösung umfasst das Erstellen einer proxy-preload.cjs-Datei und das Festlegen globaler undici-Proxy-Einstellungen.

Verwalten des Claude-Code-Kontextfensters für Kosten und Leistung
Ein Entwickler erklärt, wie jeder API-Aufruf den gesamten Konversationsverlauf sendet, wodurch der akkumulierte Verlauf zum teuren Teil wird, und teilt einen Workflow, bei dem frische Sitzungen mit Übergabenotizen gestartet werden, um Kosten zu senken und die Antwortqualität zu verbessern.

Firefox-Workaround für das Einfrieren von Claude.ai mithilfe eines Tampermonkey-Skripts
Ein Reddit-Benutzer teilt eine Tampermonkey-Skript-Lösung für Firefox-Nutzer, die Einfrierprobleme auf Claude.ai erleben. Das Skript ändert das Verhalten von Date.now(), um Zeitkonflikte zu verhindern, die zum Hängen der Oberfläche führen.