Entwickler misst Frustration mit 'F-Bombs pro tausend Prompts'-Metrik über 44.212 Claude Code-Logs

Ein Entwickler, der unter /u/ChartBuilder veröffentlicht, hat eine Metrik namens fpk entwickelt – F-Bomben pro tausend Prompts – um die Frustration bei der Nutzung von Claude Code zu quantifizieren. Die Daten umfassen 5 Monate, 44.212 Prompts und 6.120 Sitzungen.
Kopfzahlen pro Modell
- claude-opus-4-5: 38,11 fpk
- claude-opus-4-7: 11,11 fpk
- claude-haiku-4-5: 0,00 fpk (als Subagent eingesetzt, nie als Orchestrator)
Das ist ein 3,4-facher Rückgang der Frustration zwischen den beiden Opus-Versionen, der eng mit Anthropics offizieller Qualitätserholung nach der Regression von Februar bis März zusammenhängt – aber auf eine Weise sichtbar, die Release-Notes nicht erfassen.
Fpk nach Claude Code CLI-Version
- Ära 2.1.30-69: 40 fpk
- Ära 2.1.100+: 12 fpk
- Schlechteste Einzelversion: 2.1.42 mit 173,79 fpk
- Beste: 2.1.110 mit 0,00 fpk bei über 300 Prompts
Wichtige Erkenntnis: Meiste Frustration kommt von der Umgebung, nicht vom Modell
Der Autor merkt an: „Das meiste Fluchen galt nicht dem Modell. Es galt der Reibung mit der Umgebung, wie gh auth-Fehlern, Docker-Problemen, fehlerhaften Screenshots. Das Modell ist meist nur der unfreiwillige Zeuge meiner Frustration mit den umgebenden Tools, nicht die Ursache.“
Aber manchmal ist das Modell doch die Ursache – der vollständige Artikel enthält eine „Greatest Hits“-Sammlung denkwürdiger Ausbrüche.
Reproduzierbare Tools
Der Entwickler hat Tools veröffentlicht, um fpk auf eigenen Claude-Code-Logs zu berechnen:
- Vollständiger Artikel mit Methodik: mpiv.ai/blog/fpk-f-bombs-per-thousand-the-dev-experience-metric-you-didnt-know-you-needed
- Open-Source-Repository mit Audit-Tools: github.com/MPIsaac-Per/claude-code-ops-audit
Wenn Sie Claude Code intensiv nutzen und ein quantitatives Signal dafür suchen, wie viel Reibung Sie tatsächlich erleben, lohnt es sich, diese Metrik zu übernehmen. Der Rückgang zwischen Modellen und über CLI-Versionen hinweg ist ein konkreter Indikator für Anthropics Erholung – und die umgebungsbedingten Frustrationsquellen kann jedes Team angehen.
📖 Quelle lesen: r/ClaudeAI
👀 Siehe auch

SkyClaw: Rust AI Agent Runtime für Cloud VPS mit Telegram-Steuerung
SkyClaw ist eine 6,9 MB große, in Rust geschriebene KI-Agenten-Laufzeitumgebung, die für die Bereitstellung auf Cloud-VPS mit Telegram als einziger Schnittstelle konzipiert ist. Sie führt Shell-Befehle aus, durchsucht das Web über headless Chrome, liest/schreibt Dateien und ruft URLs mit mehrstufiger Werkzeugverkettung ab.

Open-Source-Tool misst Autonomie von KI-Codierungsagenten mit lokaler Datenanalyse
Codelens-AI ist ein Open-Source-CLI-Tool, das Claude-Code-Sitzungsdateien zusammen mit dem Git-Verlauf analysiert, um Autonomie-Metriken wie Autopilot-Verhältnis und Self-Heal-Score zu berechnen. Das Tool läuft lokal ohne Einrichtung mit npx claude-roi und behält alle Daten auf Ihrem Rechner.

OpenProphet: Open-Source Autonomer Handelsagent mit Web-Oberfläche
OpenProphet ist ein Open-Source, autonomer Handelsagent mit einer Web-Oberfläche, die mehrere Alpaca-Konten gleichzeitig unterstützt und auf OpenCode läuft. Es ermöglicht die Konfiguration von Agenten-Personas und Strategien, wobei jeder LLM verwendet werden kann, nicht nur Claude.

Ops Dashboard OpenClaw: Lokales Dashboard für Solo-Entwickler mit mehreren Repos
Ein Solo-Entwickler hat ops-dashboard entwickelt, eine lokale App, die Obsidian-Vaults, Repos und Logs in ein einziges durchsuchbares Dashboard integriert. BYOK, MIT-lizenziert, keine Cloud erforderlich.