Homme des cavernes : Une Compétence de Code Claude Qui Réduit de 75 % les Tokens en Utilisant un Discours de Style Homme des Cavernes

Ce que fait Caveman
Caveman est une compétence Claude Code qui fait parler Claude comme un homme des cavernes, réduisant environ 75 % des tokens tout en conservant une précision technique complète. L'approche est basée sur l'observation que le langage d'homme des cavernes réduit considérablement l'utilisation de tokens LLM sans perdre la substance technique.
Exemples avant et après
La source fournit des exemples spécifiques de réduction de tokens :
- Claude normal (69 tokens) : "La raison pour laquelle votre composant React se re-rend est probablement parce que vous créez une nouvelle référence d'objet à chaque cycle de rendu. Lorsque vous passez un objet en ligne comme prop, la comparaison superficielle de React le voit comme un objet différent à chaque fois, ce qui déclenche un re-rendu. Je recommanderais d'utiliser useMemo pour mémoriser l'objet."
- Claude Caveman (19 tokens) : "Nouvelle référence objet chaque rendu. Prop objet en ligne = nouvelle référence = re-rendu. Envelopper dans useMemo ."
- Claude normal : "Bien sûr ! Je serais ravi de vous aider avec cela. Le problème que vous rencontrez est très probablement causé par votre middleware d'authentification qui ne valide pas correctement l'expiration du token. Laissez-moi jeter un coup d'œil et suggérer une correction."
- Claude Caveman : "Bug dans middleware auth. Vérification expiration token utilise < pas <= . Correction :"
Installation
Installez avec l'une de ces commandes :
npx skills add JuliusBrussee/cavemanOu via le système de plugins Claude Code :
claude plugin marketplace add JuliusBrussee/caveman
claude plugin install caveman@cavemanUtilisation
Déclenchez le mode homme des cavernes avec ces phrases :
- /caveman "parler comme un homme des cavernes"
- "mode homme des cavernes"
- "moins de tokens s'il vous plaît"
Arrêtez le mode homme des cavernes avec :
- "arrêter homme des cavernes"
- "mode normal"
Ce que Caveman change et conserve
Caveman supprime :
- Les mots de remplissage
- Les articles (un, une, le, la)
- Les politesses (par exemple, "Bien sûr, je serais ravi de")
- Les atténuations (par exemple, "Il pourrait être intéressant de considérer")
Caveman conserve :
- Les blocs de code (écrit normalement)
- Les termes techniques (par exemple, polymorphisme reste polymorphisme)
- Les messages d'erreur (cite exactement)
- Les commits Git et PR (écrit normalement)
Avantages et fonctionnement
La source revendique ces avantages :
- 75 % de tokens économisés
- 100 % de précision technique maintenue
- Augmentation de vitesse d'environ 3x
- 75 % de coût en moins sur la sortie
- Réponses plus rapides grâce à moins de tokens à générer
Caveman élimine les tokens gaspillés sur des phrases comme :
- "Je serais ravi de vous aider avec cela" (8 tokens gaspillés)
- "La raison pour laquelle cela se produit est parce que" (7 tokens gaspillés)
- "Je recommanderais que vous considériez" (7 tokens gaspillés)
- "Bien sûr, laissez-moi jeter un coup d'œil à cela pour vous" (10 tokens gaspillés)
Détails du dépôt
Le dépôt a 746 étoiles, 14 forks et utilise la licence MIT. La dernière version est v1.0.0 du 4 avril 2026.
📖 Lire la source complète : HN AI Agents
👀 See Also

Kelet : Analyse Automatisée des Causes Racines pour Agents IA
Kelet est un service qui analyse automatiquement les défaillances des agents d'IA en production en regroupant les traces et signaux pour identifier les causes racines et suggérer des correctifs. Il s'intègre via des SDK Python/TypeScript ou une compétence d'installation et est actuellement gratuit pendant la phase bêta.

Développeur Construit un Serveur MCP pour l'Intégration WhatsApp de Claude, Partage les Défis
Un développeur a créé un serveur MCP pour donner à Claude l'accès à de vraies conversations WhatsApp, découvrant que la gestion du contexte des conversations était plus délicate que prévu et nécessitait une base de données pour suivre les conversations.

Le pipeline MCP à appel unique réduit l'utilisation des tokens de Claude Code de 74 %.
Un développeur a créé un serveur MCP de moteur contextuel qui fournit à Claude Code un graphe de dépendances des bases de code, réduisant l'utilisation de tokens de 65 % initialement. Un nouveau pipeline en un seul appel réduit encore les tokens de 74 % en éliminant les allers-retours multiples et en dédupliquant les résultats côté serveur.

Cartes-éclair de codage : 800+ cartes Anki pour Rust, SQLite, Godot et langage Wolfram
Plus de 800 flashcards en Markdown couvrant Rust, SQLite, Godot et le langage Wolfram à partir des premiers principes, avec des scripts pour les convertir en decks Anki ou en PDF.