Cavernícola: Uma Habilidade de Código do Claude que Corta 75% dos Tokens Usando Fala Estilo Caverna

O que o Caveman Faz
Caveman é uma habilidade do Claude Code que faz o Claude falar como um homem das cavernas, cortando aproximadamente 75% dos tokens enquanto mantém total precisão técnica. A abordagem é baseada na observação de que a fala de homem das cavernas reduz drasticamente o uso de tokens de LLM sem perder a substância técnica.
Exemplos Antes e Depois
A fonte fornece exemplos específicos de redução de tokens:
- Claude Normal (69 tokens): "O motivo pelo qual seu componente React está sendo renderizado novamente provavelmente é porque você está criando uma nova referência de objeto em cada ciclo de renderização. Quando você passa um objeto inline como prop, a comparação superficial do React o vê como um objeto diferente a cada vez, o que aciona uma nova renderização. Eu recomendaria usar useMemo para memorizar o objeto."
- Claude Caveman (19 tokens): "Nova ref objeto cada render. Prop objeto inline = nova ref = re-render. Envolver em useMemo ."
- Claude Normal: "Claro! Ficaria feliz em ajudá-lo com isso. O problema que você está enfrentando provavelmente é causado pelo seu middleware de autenticação não validar corretamente a expiração do token. Deixe-me dar uma olhada e sugerir uma correção."
- Claude Caveman: "Bug no middleware auth. Verificação expiração token usa < não <= . Corrigir:"
Instalação
Instale com um destes comandos:
npx skills add JuliusBrussee/cavemanOu através do sistema de plugins do Claude Code:
claude plugin marketplace add JuliusBrussee/caveman
claude plugin install caveman@cavemanUso
Ative o modo caveman com estas frases:
- /caveman "falar como homem das cavernas"
- "modo caveman"
- "menos tokens por favor"
Pare o modo caveman com:
- "parar caveman"
- "modo normal"
O que o Caveman Muda e Mantém
Caveman remove:
- Palavras de preenchimento
- Artigos (um, uma, o, a)
- Cumprimentos (ex: "Claro, ficaria feliz em")
- Hesitações (ex: "Pode valer a pena considerar")
Caveman mantém:
- Blocos de código (escreve normalmente)
- Termos técnicos (ex: polimorfismo permanece polimorfismo)
- Mensagens de erro (cita exatamente)
- Commits do Git & PRs (escreve normalmente)
Benefícios e Como Funciona
A fonte afirma estes benefícios:
- 75% de tokens economizados
- 100% de precisão técnica mantida
- Aumento de velocidade de ~3x
- 75% menos custo na saída
- Respostas mais rápidas devido a menos tokens para gerar
Caveman elimina tokens desperdiçados em frases como:
- "Ficaria feliz em ajudá-lo com isso" (8 tokens desperdiçados)
- "O motivo pelo qual isso está acontecendo é porque" (7 tokens desperdiçados)
- "Eu recomendaria que você considerasse" (7 tokens desperdiçados)
- "Claro, deixe-me dar uma olhada nisso para você" (10 tokens desperdiçados)
Detalhes do Repositório
O repositório tem 746 estrelas, 14 forks e usa a licença MIT. A versão mais recente é v1.0.0 de 4 de abril de 2026.
📖 Read the full source: HN AI Agents
👀 See Also

Desenvolvedor cria framework de IA com 17 princípios biológicos usando Claude Code
Um desenvolvedor criou um framework de IA chamado Cognitive Sparks implementando 17 princípios biológicos como disparo por limiar e plasticidade hebbiana, baseado no livro de 1999 'Sparks of Genius'. Todo o projeto—22 documentos de design e 3.300 linhas de código—foi construído em um dia usando Claude Code, sem nenhum código escrito por humanos.

O fork vllm-mlx adiciona chamada de ferramentas e cache de prompt para agentes de IA de codificação local.
Um desenvolvedor modificou o vllm-mlx para corrigir problemas de chamada de ferramentas e adicionar cache de prompt, reduzindo o TTFT de 28s para 0,3s no OpenClaw para Apple Silicon. O fork suporta Qwen3-Coder-Next a 65 tok/s no M3 Ultra com chamada de funções funcionando.

Calmkeep: Uma Camada de Continuidade Externa para Combater a Deriva de LLM em Sessões Estendidas
Calmkeep é uma camada de continuidade externa projetada para neutralizar a deriva de LLMs em sessões prolongadas, apresentando 85% de integridade contra 60% do Claude padrão em um teste de construção de backend de 25 turnos e 100% contra 50% em uma sessão jurídica.

O Protocolo AVP Permite que Agentes LLM Compartilhem o Cache KV em vez de Texto para Eficiência de Tokens
AVP (Protocolo de Vetor de Agente) permite que agentes LLM passem o cache KV diretamente entre eles em vez de texto, reduzindo o processamento de tokens em 73-78% e alcançando acelerações de 2-4x nos modelos Qwen, Llama e DeepSeek. O protocolo funciona com conectores HuggingFace e vLLM e está disponível como um pacote Python.