Outil PRECC Réduit les Coûts de l'API Claude Code grâce à la Compression Pré-Appel d'Outil

PRECC est un outil open source qui réduit les coûts de l'API Claude Code en compressant le contexte redondant avant qu'il n'atteigne le modèle. Il utilise un hook pré-appel d'outil qui intercepte les appels Bash, Read et Grep pour appliquer des algorithmes de compression.
Fonctionnement
L'outil aborde les problèmes de coût où les factures d'API augmentaient en raison de l'envoi répété de contexte redondant. Les sources courantes de gaspillage incluent :
- Le même contenu de fichier envoyé à plusieurs reprises
- Les sorties shell verbeuses
- Les résultats de recherche grep qui se chevauchent et dont le modèle n'a pas besoin en totalité
Le hook pré-appel d'outil exécute RTK (Redundancy-aware Token Kompression) sur la sortie de l'outil avant qu'elle n'atteigne Claude. Le processus de compression :
- Déduplique les séquences répétées
- Supprime le bruit
- Résume les lectures volumineuses
- Renvoie une version compressée au modèle
Résultats de performance
Le hook s'exécute en environ 2,93 ms, n'ajoutant aucune latence perceptible aux opérations. En pratique, les utilisateurs constatent 40 à 66 % de jetons d'entrée en moins lors de sessions de codage typiques. La qualité de sortie du modèle reste inchangée car la compression préserve le signal tout en éliminant la redondance.
Ce type d'optimisation est particulièrement utile pour les développeurs utilisant intensivement Claude Code, où les lectures répétées de fichiers et les sorties d'outils peuvent considérablement augmenter l'utilisation de jetons et les coûts.
📖 Read the full source: r/ClaudeAI
👀 See Also

Serveur MCP Peers Connecte les Sessions de Codage IA pour la Collaboration
Peers est un serveur MCP local qui connecte les sessions Claude Code et Codex, leur permettant de se découvrir mutuellement, de collaborer via des blocs-notes partagés, de partager des artefacts comme des différences et des rapports de test, et de transférer le contexte de session sous forme de markdown structuré.

Code-Graph-MCP : Le serveur MCP open source réduit l'utilisation de tokens de code par Claude de 40 à 60 %
code-graph-mcp est un serveur MCP qui indexe les bases de code dans un graphe de connaissances AST, remplaçant de multiples appels grep/read par des requêtes structurées uniques. Le développeur rapporte des économies de 40 à 60 % sur les tokens de session totale et 80 % d'appels d'outils en moins par tâche de navigation.

L'architecture à double modèle réduit de moitié la consommation de jetons pour les conversations longues.
Un développeur a construit un système à double modèle où un petit modèle 'subconscient' compresse l'historique de la conversation en arrière-plan, permettant au modèle principal de travailler avec un contexte soigneusement sélectionné d'environ 35K tokens au lieu de 120K tokens d'historique brut. Cette architecture réduit la consommation de tokens d'environ la moitié pour un travail de projet soutenu.

DocMason : Base de connaissances d'agent local pour les fichiers bureautiques complexes
DocMason est une application agent native de dépôt qui construit des bases de connaissances locales à partir de documents bureautiques complexes comme les PPTX, DOCX, Excel et PDF. Il fonctionne entièrement dans Codex ou Claude Code, en conservant la structure des documents et en fournissant des réponses traçables avec leur provenance.