Analyse von Claudes Token-Verbrennung bei 1M Kontextfenster: Daten zeigen unbegrenztes Wachstum und kumulierte Cache-Fehlschläge

Token-Verbrauchsanalyse aus realen Nutzungsdaten
Eine detaillierte Analyse der Implementierung von Claudes 1-Millionen-Token-Kontextfenster zeigt spezifische technische Faktoren, die einen schnellen Token-Verbrauch verursachen. Der Autor analysierte JSONL-Sitzungsdateien über mehrere Konversationen hinweg, um Muster zu identifizieren.
Wichtige Erkenntnisse aus den Daten
Unbegrenztes Kontextwachstum: Vor dem 1-Millionen-Token-Kontextfenster wurde die automatische Komprimierung bei etwa 160.000 Token ausgelöst. Nach der 1-Millionen-Implementierung ist diese Obergrenze weg, sodass Sitzungen regelmäßig 500.000+ Token erreichen. Jede Eingabe sendet den gesamten Kontext erneut, was bedeutet, dass bei 500.000 Token selbst eine einfache Bestätigung 500.000 Token kostet. Wenn Claude 3 Tool-Aufrufe tätigt, um eine Eingabe zu beantworten, sind das 1,5 Millionen Token für eine einzige Interaktion.
Verstärkung durch Cache-Fehlzugriffe: Anthropic speichert den Kontext serverseitig für etwa 5 Minuten zwischen. Nach diesem Zeitfenster verarbeitet die nächste Eingabe den gesamten Kontext erneut, was etwa das 10-fache des zwischengespeicherten Preises kostet. Obwohl die Cache-Fehlzugriffsrate unverändert geblieben ist (etwa 2,5 % der Interaktionen), ist ein Cache-Fehlzugriff bei 500.000 Token-Kontext deutlich teurer als bei 150.000 Token-Kontext.
Analysetool
Der Autor hat ein Python-Skript erstellt, das Token-Zählungen aus Claude-JSONL-Sitzungsdateien analysiert, ohne auf den Konversationsinhalt zuzugreifen. Das Skript erkennt automatisch Ihr Claude-Datenverzeichnis und benötigt matplotlib und numpy. Das Skript ist verfügbar unter: https://github.com/RyanSeanPhillips/cldctrl/blob/master/docs/context_analysis.py
Der Autor erwähnt auch CLD CTRL (https://github.com/RyanSeanPhillips/cldctrl), ein Terminal-Dashboard zum Starten und Überwachen von Claude Code-Sitzungen, Token-Verbrauch und Projektaktivitäten.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Höhlenmensch vs 'Sei kurz' Prompt: Benchmarking von Komprimierungs-Prompts für Claude
Ein 24-Prompt-Benchmark über 5 Arme zeigt, dass der 2-Wort-Prompt „be brief.“ sowohl bei der Tokenanzahl als auch bei der Ausgabequalität mit der Höhlenmensch-Kompression mithalten kann, obwohl Höhlenmensch strukturelle Konsistenz und Sicherheits-Escape-Funktionen bietet.

Bundesbehörden angewiesen, die Nutzung von Anthropic-KI-Technologie einzustellen
Präsident Donald Trump hat US-Regierungsbehörden angewiesen, die Nutzung von Technologie des KI-Unternehmens Anthropic sofort einzustellen. Die Anordnung erfolgt, während Anthropic unter Druck des Verteidigungsministeriums steht, Nutzungsbeschränkungen für seine KI-Modelle aufzuheben.

Claude Sonnet 4.6 schlägt Opus 4.6 bei der Ausführung im Prompt-Benchmark
Ein Reddit-Benutzer reichte einen komplexen Prompt sowohl bei Sonnet 4.6 als auch bei Opus 4.6 ein; das Sonnet-Modell lieferte eine überlegene Antwort, bewertet nach Kreativität und versteckten Anforderungen.

Delve wird beschuldigt, Sim.ai's Open-Source-Software SimStudio geforkt und als Pathways verkauft zu haben.
Das Compliance-Startup Delve soll angeblich das Open-Source-Agenten-Entwicklungstool SimStudio von Sim.ai geforkt, es in Pathways umbenannt und ohne ordnungsgemäße Lizenzzuweisung oder finanzielle Vereinbarung mit Sim.ai verkauft haben, was möglicherweise gegen die Apache-Lizenzbedingungen verstößt.