Réducteur de Tokens : Un Plugin Claude Code pour la Compression Intelligente du Contexte

✍️ OpenClawRadar📅 Publié: April 14, 2026🔗 Source
Réducteur de Tokens : Un Plugin Claude Code pour la Compression Intelligente du Contexte
Ad

Token Reducer est un plugin Claude Code qui résout le problème de consommation excessive de tokens lors du travail avec des dépôts de taille moyenne à grande. L'outil traite le contexte du dépôt localement avant de l'envoyer à Claude, réduisant considérablement la taille du contexte sans perdre le code pertinent.

Fonctionnement

Le plugin utilise plusieurs techniques pour compresser intelligemment le contexte :

  • Découpage basé sur AST — Analyse le code en unités significatives (fonctions, classes, blocs) au lieu d'un simple découpage textuel
  • Récupération hybride — Combine BM25 (correspondance de mots-clés) avec la similarité vectorielle pour trouver les segments les plus pertinents
  • Compression TextRank — Applique une synthèse extractive pour conserver les parties importantes et éliminer le bruit
  • Cartographie du graphe d'import — Trace les dépendances pour que le code lié reste ensemble
  • Expansion de symboles à 2 sauts — Lorsqu'on travaille sur une fonction A qui appelle une fonction B, elle inclut automatiquement le contexte de B

Performances et tests

Lors des tests sur des dépôts Python, TypeScript et JavaScript, le développeur rapporte une réduction de 90 à 98 % de la taille du contexte sans perte du code pertinent pour la tâche. L'outil a été construit en utilisant Claude lui-même pour itérer sur l'architecture, en commençant par un découpeur basique et en testant sur des tâches de codage réelles jusqu'à obtenir une compression serrée mais préservant le contexte.

Ad

Installation et disponibilité

Token Reducer est entièrement gratuit et sous licence MIT. Pour l'installer :

/plugin marketplace add Madhan230205/token-reducer

Le code source est disponible sur GitHub à github.com/Madhan230205/token-reducer. Le développeur sollicite des retours sur les cas où la compression aide les flux de travail, les situations où un contexte important est perdu, et les langages ou structures de dépôt nécessitant une meilleure prise en charge.

Détails techniques

Le plugin fonctionne entièrement localement, sans API cloud et sans que les données ne quittent votre machine. Il a été empaqueté en tant que plugin Claude Code après avoir fonctionné de manière fiable sur les propres projets du développeur. Le dépôt est ouvert aux contributions, avec de la place pour optimiser pour différents langages, ajouter une mise en cache plus intelligente ou ajuster les paramètres de récupération.

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

Google Research présente TurboQuant pour la compression de modèles d'IA.
Tools

Google Research présente TurboQuant pour la compression de modèles d'IA.

Google Research a présenté TurboQuant, un algorithme de compression qui réduit la taille des modèles d'IA sans perte de précision. Il traite la surcharge mémoire dans la quantification vectorielle et améliore les performances du cache clé-valeur.

OpenClawRadar
L'application Gullivr Travel s'intègre avec Claude via un serveur MCP distant
Tools

L'application Gullivr Travel s'intègre avec Claude via un serveur MCP distant

Un développeur a créé Gullivr, une application de planification de voyage avec un serveur MCP distant qui permet à Claude de créer et gérer des voyages directement dans l'application. L'intégration permet des mises à jour en temps réel pendant la discussion avec Claude, éliminant la copie manuelle entre les outils.

OpenClawRadar
Serveur MCP Ajoute une Mémoire Persistante avec Notation de Récupération à Claude Code
Tools

Serveur MCP Ajoute une Mémoire Persistante avec Notation de Récupération à Claude Code

Un développeur a créé un serveur MCP appelé engram-mcp qui donne à Claude Code une mémoire persistante entre les sessions et les projets, avec un système de notation automatique des récupérations basé sur le succès des résultats et une détection de dérive pour les connaissances obsolètes.

OpenClawRadar
Lightpanda : navigateur headless open-source pour agents LLM avec serveur MCP natif et sortie en markdown
Tools

Lightpanda : navigateur headless open-source pour agents LLM avec serveur MCP natif et sortie en markdown

Lightpanda est un navigateur headless open-source conçu pour les agents alimentés par LLM qui utilise 16 fois moins de mémoire que Chrome (215 Mo contre 2 Go) et termine les benchmarks de crawling web en 5 secondes au lieu de 47 secondes. Il fournit une sortie markdown native, un arbre sémantique avec détection d'interactivité, et un serveur MCP intégré.

OpenClawRadar