Entwickler misst Frustration mit 'F-Bombs pro tausend Prompts'-Metrik über 44.212 Claude Code-Logs

✍️ OpenClawRadar📅 Veröffentlicht: 5. Mai 2026🔗 Source
Entwickler misst Frustration mit 'F-Bombs pro tausend Prompts'-Metrik über 44.212 Claude Code-Logs
Ad

Ein Entwickler, der unter /u/ChartBuilder veröffentlicht, hat eine Metrik namens fpk entwickelt – F-Bomben pro tausend Prompts – um die Frustration bei der Nutzung von Claude Code zu quantifizieren. Die Daten umfassen 5 Monate, 44.212 Prompts und 6.120 Sitzungen.

Kopfzahlen pro Modell

  • claude-opus-4-5: 38,11 fpk
  • claude-opus-4-7: 11,11 fpk
  • claude-haiku-4-5: 0,00 fpk (als Subagent eingesetzt, nie als Orchestrator)

Das ist ein 3,4-facher Rückgang der Frustration zwischen den beiden Opus-Versionen, der eng mit Anthropics offizieller Qualitätserholung nach der Regression von Februar bis März zusammenhängt – aber auf eine Weise sichtbar, die Release-Notes nicht erfassen.

Fpk nach Claude Code CLI-Version

  • Ära 2.1.30-69: 40 fpk
  • Ära 2.1.100+: 12 fpk
  • Schlechteste Einzelversion: 2.1.42 mit 173,79 fpk
  • Beste: 2.1.110 mit 0,00 fpk bei über 300 Prompts

Wichtige Erkenntnis: Meiste Frustration kommt von der Umgebung, nicht vom Modell

Der Autor merkt an: „Das meiste Fluchen galt nicht dem Modell. Es galt der Reibung mit der Umgebung, wie gh auth-Fehlern, Docker-Problemen, fehlerhaften Screenshots. Das Modell ist meist nur der unfreiwillige Zeuge meiner Frustration mit den umgebenden Tools, nicht die Ursache.“

Aber manchmal ist das Modell doch die Ursache – der vollständige Artikel enthält eine „Greatest Hits“-Sammlung denkwürdiger Ausbrüche.

Ad

Reproduzierbare Tools

Der Entwickler hat Tools veröffentlicht, um fpk auf eigenen Claude-Code-Logs zu berechnen:

Wenn Sie Claude Code intensiv nutzen und ein quantitatives Signal dafür suchen, wie viel Reibung Sie tatsächlich erleben, lohnt es sich, diese Metrik zu übernehmen. Der Rückgang zwischen Modellen und über CLI-Versionen hinweg ist ein konkreter Indikator für Anthropics Erholung – und die umgebungsbedingten Frustrationsquellen kann jedes Team angehen.

📖 Quelle lesen: r/ClaudeAI

Ad

👀 Siehe auch

SkyClaw: Rust AI Agent Runtime für Cloud VPS mit Telegram-Steuerung
Werkzeuge

SkyClaw: Rust AI Agent Runtime für Cloud VPS mit Telegram-Steuerung

SkyClaw ist eine 6,9 MB große, in Rust geschriebene KI-Agenten-Laufzeitumgebung, die für die Bereitstellung auf Cloud-VPS mit Telegram als einziger Schnittstelle konzipiert ist. Sie führt Shell-Befehle aus, durchsucht das Web über headless Chrome, liest/schreibt Dateien und ruft URLs mit mehrstufiger Werkzeugverkettung ab.

OpenClawRadar
Open-Source-Tool misst Autonomie von KI-Codierungsagenten mit lokaler Datenanalyse
Werkzeuge

Open-Source-Tool misst Autonomie von KI-Codierungsagenten mit lokaler Datenanalyse

Codelens-AI ist ein Open-Source-CLI-Tool, das Claude-Code-Sitzungsdateien zusammen mit dem Git-Verlauf analysiert, um Autonomie-Metriken wie Autopilot-Verhältnis und Self-Heal-Score zu berechnen. Das Tool läuft lokal ohne Einrichtung mit npx claude-roi und behält alle Daten auf Ihrem Rechner.

OpenClawRadar
OpenProphet: Open-Source Autonomer Handelsagent mit Web-Oberfläche
Werkzeuge

OpenProphet: Open-Source Autonomer Handelsagent mit Web-Oberfläche

OpenProphet ist ein Open-Source, autonomer Handelsagent mit einer Web-Oberfläche, die mehrere Alpaca-Konten gleichzeitig unterstützt und auf OpenCode läuft. Es ermöglicht die Konfiguration von Agenten-Personas und Strategien, wobei jeder LLM verwendet werden kann, nicht nur Claude.

OpenClawRadar
Ops Dashboard OpenClaw: Lokales Dashboard für Solo-Entwickler mit mehreren Repos
Werkzeuge

Ops Dashboard OpenClaw: Lokales Dashboard für Solo-Entwickler mit mehreren Repos

Ein Solo-Entwickler hat ops-dashboard entwickelt, eine lokale App, die Obsidian-Vaults, Repos und Logs in ein einziges durchsuchbares Dashboard integriert. BYOK, MIT-lizenziert, keine Cloud erforderlich.

OpenClawRadar