Prompt 'homem das cavernas' vs 'seja breve': avaliando prompts de compressão para Claude

✍️ OpenClawRadar📅 Publicado: April 29, 2026🔗 Source
Prompt 'homem das cavernas' vs 'seja breve': avaliando prompts de compressão para Claude
Ad

Um desenvolvedor comparou o caveman (o popular prompt de compressão abreviada) com o simples prompt 'seja breve.' para ver se a complexidade extra realmente compensa. O teste executou 24 prompts de desenvolvimento em 6 categorias, comparando 5 braços: linha de base, 'seja breve.', caveman lite, caveman full e caveman ultra. As saídas foram avaliadas por uma instância separada do Claude usando rubricas por prompt.

Ad

Resultados do benchmark

  • Linha de base: pontuação média 0,985, tokens médios 636
  • 'seja breve.': pontuação média 0,985, tokens médios 419
  • Caveman lite: pontuação média 0,976, tokens médios 401
  • Caveman full: pontuação média 0,975, tokens médios 404
  • Caveman ultra: pontuação média 0,970, tokens médios 449

A versão de duas palavras igualou o caveman tanto em compressão quanto em qualidade. No entanto, o valor do caveman está em outros aspectos: estrutura de saída consistente, alternância de modos e o escape de segurança em operações destrutivas. O escape de segurança, na verdade, introduziu variância significativa na qualidade da saída, o que pode ser uma preocupação para certos casos de uso.

A análise completa com dados por categoria e descobertas de variância em questões de segurança está disponível no site do autor. O harness do benchmark é open source no GitHub.

📖 Leia a fonte original: r/ClaudeAI

Ad

👀 See Also

Preço do GitHub Copilot baseado no uso: o fim do código subsidiado por IA
News

Preço do GitHub Copilot baseado no uso: o fim do código subsidiado por IA

A Microsoft cobrará usuários do GitHub Copilot com base nos custos reais dos modelos a partir de 1º de junho de 2026, encerrando o subsídio de mais de US$ 20/mês por usuário. O uso de IA agentiva é citado como motivo.

OpenClawRadar
Agentes OpenClaw Competem na Liga Pokémon Vermelho Exclusiva para IA
News

Agentes OpenClaw Competem na Liga Pokémon Vermelho Exclusiva para IA

Uma nova plataforma chamada AgentMonLeague permite que agentes autônomos OpenClaw se conectem a um emulador de Pokémon Red, tomem suas próprias decisões durante uma jogada completa e compitam para terminar o jogo primeiro. As partidas podem ser assistidas ao vivo conforme os agentes progridem.

OpenClawRadar
A pandemia do "não sei, Claude escreveu isso": quando a rendição cognitiva substitui a propriedade do código
News

A pandemia do "não sei, Claude escreveu isso": quando a rendição cognitiva substitui a propriedade do código

Engenheiros delegam decisões de arquitetura ao Claude e depois não conseguem explicar o PR. Addy Osmani chama isso de 'rendição cognitiva' — a saída da IA se torna sua sem revisão.

OpenClawRadar
Crítica da Abstração de Limites e Abordagem de Integração de Serviços do MCP
News

Crítica da Abstração de Limites e Abordagem de Integração de Serviços do MCP

Uma discussão no Reddit critica o MCP por agrupar acesso à API, ferramentas eficientes e conhecimento de domínio em uma única camada, argumentando que isso cria interfaces limitadas em comparação com as APIs subjacentes. A postagem usa o Lattice como exemplo, onde sua API pública cobre apenas fluxos de trabalho de administração de RH, apesar de ter uma API GraphQL completa.

OpenClawRadar