Claude Code Token-Verschwendung beheben: Deaktiviere Attribution-Header für bessere Cache-Treffer

✍️ OpenClawRadar📅 Veröffentlicht: 1. April 2026🔗 Source
Claude Code Token-Verschwendung beheben: Deaktiviere Attribution-Header für bessere Cache-Treffer
Ad

Claude Code verschwendet seit Version 2.1.69 bei jeder neuen Sitzung Tokens aufgrund eines Abrechnungszuordnungs-Headers, der das Prompt-Caching unterbricht. Das Problem ist in mehreren GitHub-Issues (#40652, #34629, #40524) dokumentiert, ohne dass es bis zur Veröffentlichung dieser Quelle eine offizielle Antwort von Anthropic gab.

Was passiert

Seit v2.1.69 fügt Claude Code eine Abrechnungszuordnungs-Zeichenkette in den ersten Block Ihres System-Prompts ein: x-anthropic-billing-header: cc_version=2.1.88.a3f; cc_entrypoint=cli; cch=00000;

Der Teil .a3f ist ein 3-stelliger Hash, der aus Ihrer ersten Nachricht in jeder Konversation mit dieser Funktion berechnet wird:

function computeHash(firstUserMessage, version) {
  const chars = [4, 7, 20].map(i => firstUserMessage[i] || "0").join("");
  return sha256("59cf53e54c78" + chars + version).slice(0, 3);
}

Verschiedene Konversationen mit unterschiedlichen ersten Nachrichten generieren jedes Mal verschiedene Hashes.

Warum dies das Caching unterbricht

Anthropics Caching erfordert 100 % identische Prompt-Segmente. Der Cache wird über Ihre gesamte Organisation oder Ihren gesamten Arbeitsbereich hinweg geteilt, nicht pro Sitzung. Der Abrechnungs-Header befindet sich am Anfang des ~23K Token großen System-Prompts, und da er sich pro Konversation ändert, stimmt das Präfix nie überein, was bei jedem neuen Chat zu Cache-Fehlschlägen führt.

Ad

Benchmark-Ergebnisse

Ein kontrollierter A/B-Test zeigte:

  • Header EIN (Standard): 48 % Cache-Trefferquote, ~12K Tokens pro Sitzung neu aufgebaut
  • Header AUS: 99,98 % Cache-Trefferquote, bei 3 von 4 Sitzungen keine Cache-Erstellung

Das Ergebnis sind 7-fach niedrigere Kosten pro Sitzung für die System-Prompt-Verarbeitung.

Die Lösung

Fügen Sie dies Ihrer Shell-Konfiguration hinzu:

export CLAUDE_CODE_ATTRIBUTION_HEADER=false

Für zsh-Benutzer:

echo 'export CLAUDE_CODE_ATTRIBUTION_HEADER=false' >> ~/.zshrc
source ~/.zshrc

Neue Sitzungen übernehmen es automatisch. Bestehende Sitzungen müssen nicht neu gestartet werden – der Hash ändert sich nicht mitten in einer Konversation, und sie beeinträchtigen neue Sitzungen nicht.

Sicherheit und Hintergrund

Dies ist kein Hack – die Umgebungsvariable existiert im Quellcode als ordnungsgemäßer Feature-Toggle. claude-code-router und CLIProxyAPI wurden mit dieser deaktivierten Einstellung in Produktion ausgeliefert, ohne gemeldete Probleme.

Anthropic hat dies wahrscheinlich implementiert, um zu verfolgen, welche Version und welcher Einstiegspunkt (CLI vs. SDK vs. GitHub Action) jeden API-Aufruf getätigt hat, und platziert es im System-Prompt, weil Bedrock/Vertex keine benutzerdefinierten Header weiterleiten.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

Automatisiertes QA und Testen mit KI: Eine neue Ära für Softwaretests
Tipps

Automatisiertes QA und Testen mit KI: Eine neue Ära für Softwaretests

Antirez beschreibt den Einsatz von LLM-Agenten für automatisierte QA: Eine Markdown-Datei weist den Agenten an, manuelle Tests an neuen Releases durchzuführen. Angewendet auf DwarfStar und Redis Arrays hebt dieser Ansatz die Softwarequalität, ohne an Gründlichkeit einzubüßen.

OpenClawRadar
Wie man Claude Codes CSS-Raten mit einem Design-System behebt
Tipps

Wie man Claude Codes CSS-Raten mit einem Design-System behebt

Ein Entwickler stellte fest, dass Claude Code wiederholt falsch ausgerichtetes HTML/CSS neu generierte, da es blind ohne visuelles Feedback entwirft. Die Lösung: ein vollständiges Designsystem mit Abständen, Farben und Typvariablen bereitstellen, dann HTML- und CSS-Prompts trennen.

OpenClawRadar
Drei übersehene Engpässe in KI-Agent-Workflows: Aufnahme, Kontextmanagement und Modell-Routing
Tipps

Drei übersehene Engpässe in KI-Agent-Workflows: Aufnahme, Kontextmanagement und Modell-Routing

Eine tiefgehende Analyse der drei oft übersehenen Schichten bei der Optimierung von KI-Agenten: saubere Eingabeaufbereitung, Kontextfensterverwaltung über mehrere Schritte hinweg und aufgabengerechte Modelllenkung. Praktische Lösungen umfassen die Verwendung strukturierten Parsings, zusammengefasster Schrittausgaben, typisierter Schemata und der Anpassung von Modellen an die Aufgabenkomplexität.

OpenClawRadar
Fordere KI auf, ihre eigenen Begriffe aus ersten Prinzipien zu definieren für bessere Ergebnisse und nachvollziehbare Begründungen
Tipps

Fordere KI auf, ihre eigenen Begriffe aus ersten Prinzipien zu definieren für bessere Ergebnisse und nachvollziehbare Begründungen

Ein Nutzer auf r/ClaudeAI hat herausgefunden, dass das Hinzufügen einer einzigen Anweisung, undefinierte Begriffe vor der weiteren Bearbeitung auf ihre atomare Bedeutung herunterzubrechen, spezifischere Ausgaben liefert und Debugging durch eine nachvollziehbare Argumentationskette ermöglicht.

OpenClawRadar