Fable 5 in Claude Code: Kostenanalyse des ersten Tages — 210 Dollar API-Äquivalent, 0 Dollar bezahlt

Ein Entwickler auf r/ClaudeAI stellte sein Claude-Code-Standardmodell am Starttag auf claude-fable-5 um und verfolgte die gesamte Nutzung des Tages mit den integrierten Sitzungsprotokollen von Claude Code. Die Ergebnisse: 742 Fable-Antworten in 5 Sitzungen, mit API-äquivalenten Kosten von 210,15 $ – aber tatsächlich 0,00 $ bezahlt, dank des Aktionszeitraums bis zum 22. Juni.
Methodik
Claude Code schreibt Sitzungsprotokolle als lokale JSONL-Dateien, einschließlich der Token-Nutzung pro Nachricht. Der Entwickler analysierte jede Fable-Nachricht in allen Projekten und bewertete sie zu den veröffentlichten API-Preisen:
- Eingabe-Tokens: 10 $ pro Million
- Ausgabe-Tokens: 50 $ pro Million
- Cache-Lesevorgänge: 0,1x des Basis-Eingabepreises (1 $ pro Million)
- Cache-Schreibvorgänge: 1,25x des Basis-Eingabepreises (12,50 $ pro Million)
Starttag-Gesamtzahlen
- 742 Fable-Antworten in 5 Sitzungen
- 77.885 Eingabe-Tokens / 938.211 Ausgabe-Tokens
- 124,3 Millionen Cache-Lese-Tokens, 3,0 Millionen Cache-Schreib-Tokens
- API-äquivalente Kosten: 210,15 $
- Tatsächliche Kosten: 0,00 $ (in kostenpflichtigen Plänen bis 22. Juni enthalten)
Die hohe Anzahl an Ausgabe-Tokens (938K gegenüber 78K Eingabe) ist typisch für die agentischen Schleifen von Claude Code – das Modell iteriert, generiert Code und überarbeitet. Cache-Lesevorgänge dominieren mit 124,3 Mio. Tokens, was auf effektives Prompt-Caching hinweist.
Praktische Erkenntnis
Wenn Sie einen kostenpflichtigen Plan haben, ist Fable 5 bis zum 22. Juni ohne Aufpreis verfügbar. Die API-äquivalenten Preise geben ein Gefühl für den Ressourcenverbrauch; die tatsächlichen Plankosten sind fest. Um diese Messung zu wiederholen, analysieren Sie die JSONL-Sitzungsprotokolle unter ~/.claude/sessions/.
📖 Vollständige Quelle lesen: r/ClaudeAI
👀 Siehe auch

Claude Code-Benutzer entwickelt NVM-Plugin zur Erfassung von Problemlösungskontext
Ein Entwickler hat ein Claude-Plugin namens nvm (non-volatile memory) erstellt, das den Claude-Sitzungsverlauf in Markdown-Karten umwandelt, die Problemlösungsentscheidungen und wiederverwendbare Erkenntnisse dokumentieren. Das Tool behebt das Problem, den Überblick darüber zu verlieren, wie Probleme gelöst wurden, wenn man KI-Codierungsassistenten nutzt.

Ghostbar: Ein ~5 MB großer nativer macOS Swift AI-Client, der sich vor Bildschirmfreigabe verbirgt
Ghostbar ist ein nativer Swift macOS Menüleisten-AI-Client (~5MB), der window.sharingType = .none verwendet, um für Bildschirmrekorder unsichtbar zu sein. Funktioniert mit Ollama, vLLM, llama.cpp und jedem OpenAI-kompatiblen Backend.

KV-Cache-Wiederverwendung für lange Gespräche auf Apple Silicon ermöglicht 200-fache Beschleunigung
Ein Entwickler implementierte eine sitzungsbasierte Wiederverwendung des KV-Caches für lokale LLM-Inferenz mit Apples MLX-Framework und erreichte eine 200-fache Verbesserung der Zeit bis zum ersten Token bei einer Kontextlänge von 100K. Der Ansatz behält den KV-Cache im Speicher über Gesprächsrunden hinweg und verarbeitet nur neue Tokens.

Conduid.com indiziert über 23.000 MCP-Server in einem durchsuchbaren Verzeichnis.
Conduid.com aggregiert MCP-Server aus 11 Quellen, entfernt Duplikate und bietet Suchfunktionen, Kategorien sowie Vertrauensbewertungen basierend auf GitHub-Aktivität, Dokumentationsqualität und Wartungssignalen.