Desenvolvedor monitora frustração com métrica de 'Palavrões por Mil Prompts' em 44.212 logs do Claude Code

✍️ OpenClawRadar📅 Publicado: May 5, 2026🔗 Source
Desenvolvedor monitora frustração com métrica de 'Palavrões por Mil Prompts' em 44.212 logs do Claude Code
Ad

Um desenvolvedor publicando sob /u/ChartBuilder criou uma métrica chamada fpk — palavrões por mil prompts — para quantificar a frustração ao usar o Claude Code. Os dados abrangem 5 meses, 44.212 prompts e 6.120 sessões.

Números principais por modelo

  • claude-opus-4-5: 38,11 fpk
  • claude-opus-4-7: 11,11 fpk
  • claude-haiku-4-5: 0,00 fpk (usado como subagente, nunca orquestrador)

Isso representa uma queda de 3,4× na frustração entre as duas versões Opus, acompanhando de perto a recuperação oficial de qualidade da Anthropic após a regressão de fevereiro-março — mas visível de uma forma que as notas de versão não capturam.

Fpk por versão do Claude Code CLI

  • Era 2.1.30-69: 40 fpk
  • Era 2.1.100+: 12 fpk
  • Pior versão única: 2.1.42 com 173,79 fpk
  • Melhor: 2.1.110 com 0,00 fpk em mais de 300 prompts

Insight principal: a maior parte da frustração é ambiental, não relacionada ao modelo

O autor observa: "a maioria dos xingamentos não era para o modelo. Era para atritos ambientais, como falhas de gh auth, problemas com Docker, screenshots quebrando. O modelo é principalmente uma testemunha involuntária da minha frustração com as ferramentas ao redor, não a causa."

Mas às vezes o modelo também é a causa — o artigo completo inclui uma coleção de "melhores momentos" de explosões memoráveis.

Ad

Ferramentas reproduzíveis

O desenvolvedor publicou ferramentas para calcular fpk em seus próprios logs do Claude Code:

Se você usa o Claude Code intensivamente e quer um sinal quantitativo de quanto atrito está realmente experimentando, vale a pena adotar essa métrica. A queda entre modelos e entre versões do CLI é um indicador concreto da recuperação da Anthropic — e as fontes ambientais de raiva são algo que toda equipe pode resolver.

📖 Leia a fonte original: r/ClaudeAI

Ad

👀 See Also

Comparando Sistemas de IA Multiagente: Harness da Anthropic vs Modelo de Engenharia Organizacional da Agyn
Tools

Comparando Sistemas de IA Multiagente: Harness da Anthropic vs Modelo de Engenharia Organizacional da Agyn

A Anthropic publicou um design de estrutura para desenvolvimento de aplicações de longa duração, enquanto o sistema multiagente Agyn para engenharia de software autônoma baseada em equipe foi disponibilizado em código aberto no mês passado. Ambos os sistemas rejeitam agentes monolíticos em favor de separação de papéis, transferências estruturadas e ciclos de revisão.

OpenClawRadar
Protocolo de Memória Aberta: Um Armazenamento de Memória para Claude, ChatGPT, Cursor
Tools

Protocolo de Memória Aberta: Um Armazenamento de Memória para Claude, ChatGPT, Cursor

Open Memory Protocol (OMP) é uma especificação neutra de fornecedor e servidor de referência para memória de IA portátil. Execute um servidor auto-hospedado via Docker ou npx, conecte Claude via MCP e compartilhe memória automaticamente com ChatGPT e Cursor.

OpenClawRadar
Configuração Alternativa de IA para Programação Após Aumento de Preço do Claude
Tools

Configuração Alternativa de IA para Programação Após Aumento de Preço do Claude

Um desenvolvedor compartilha sua configuração atual de codificação com IA, usando o GPT 5.4 como modelo principal, o Codex como alternativa incluída na assinatura do ChatGPT e o Minimax 2.7 como backup com preços do plano de codificação.

OpenClawRadar
🦀
Tools

O Projeto HydraFusion do GitHub: Orquestração Multimodelo para Codificação de IA de Qualidade de Fronteira

A prévia de pesquisa HydraFusion do GitHub Copilot orquestra vários modelos por tarefa, escolhendo entre fluxos de trabalho único, cascata ou crítica. Os benchmarks mostram ganho de qualidade de 4,9 pontos com custo 67% menor em comparação ao Claude Opus 5.

OpenClawRadar