L'audit des jetons de Claude Code révèle des coûts cachés dus au chargement par défaut des outils.

✍️ OpenClawRadar📅 Publié: April 15, 2026🔗 Source
L'audit des jetons de Claude Code révèle des coûts cachés dus au chargement par défaut des outils.
Ad

Une enquête sur le gaspillage de jetons révèle une surcharge significative

Un développeur a réalisé un audit de 926 sessions de Claude Code après avoir constaté une consommation rapide de jetons suite aux changements de limites de taux d'Anthropic. L'enquête a révélé que chaque session de Claude Code commence avec une charge utile de base d'environ 45 000 jetons avant toute saisie utilisateur. Cela inclut les invites système, les définitions d'outils, les descriptions d'agents, les fichiers de mémoire, les descriptions de compétences et les schémas MCP.

Sur la fenêtre de contexte standard de 200k, cette charge de départ de 45k représente plus de 20 % du contexte disponible consommé avant même que la conversation ne commence. Comme Claude Code fonctionne en boucle sans état, tout ce contexte est reconstruit et renvoyé à chaque tour, ce qui rend la surcharge de départ un coût récurrent.

Le chargement par défaut des outils consomme beaucoup de jetons

L'audit a révélé que 20 000 jetons du contexte de départ provenaient des définitions de schémas d'outils système. Par défaut, Claude Code charge le schéma JSON complet de chaque outil disponible dans le contexte au début de la session, qu'ils soient utilisés ou non.

Le développeur a découvert un paramètre appelé enable_tool_search qui permet un chargement différé des outils. Lorsqu'il est activé, ce paramètre ne charge que 6 outils principaux initialement et charge les autres à la demande au lieu de tout déverser d'un coup.

Un changement de configuration génère des économies immédiates

Pour activer le chargement différé des outils, ajoutez ceci à votre settings.json :

{
  "env": {
    "ENABLE_TOOL_SEARCH": "true"
  }
}

Ce simple changement de configuration a réduit le contexte de départ de 45 000 à 20 000 jetons, la surcharge des outils système passant de 20 000 à 6 000 jetons. Cela économise 14 000 jetons à chaque tour de chaque session.

Ad

Implications financières des paramètres par défaut

Le développeur a calculé l'impact de ce paramètre sur son utilisation. Avec des sessions d'en moyenne 22 tours, les 14 000 jetons supplémentaires par tour représentaient 308 000 jetons inutiles par session. Sur 858 sessions, cela totalisait 264 millions de jetons.

Au tarif de lecture du cache (0,50 $/MTok), cela représentait 132 $ de coûts inutiles. Cependant, comme plus de la moitié des tours touchaient des caches expirés (ce qui déclenche le tarif complet d'entrée à 5 $/MTok), le coût réel a été estimé entre 132 $ et 1 300 $ pour ce seul paramètre par défaut.

Stratégies d'optimisation supplémentaires

Le développeur a également mis en œuvre d'autres optimisations qui ont réduit le contexte de départ de 4 000 à 5 000 jetons :

  • Réduction et remaniement des fichiers markdown et de mémoire CLAUDE
  • Consolidation des descriptions de compétences
  • Désactivation des serveurs MCP inutilisés
  • Réduction des injections de schémas provenant des crochets de mémoire

Claude Code stocke les conversations sous forme de fichiers JSONL localement dans ~/.claude/projects/, bien qu'il n'existe aucun moyen intégré d'obtenir des ventilations détaillées par session, de coût par projet ou de catégories de dépenses. La commande intégrée /insights s'est avérée insuffisante pour diagnostiquer le gaspillage.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Débogage par OpenClaw d'une configuration ESP32+CC1101 433 MHz avec HackRF sur Raspberry Pi 5
Tips

Débogage par OpenClaw d'une configuration ESP32+CC1101 433 MHz avec HackRF sur Raspberry Pi 5

Après des tentatives infructueuses avec le GPIO direct et le flashage de l'ESP32, OpenClaw a utilisé un HackRF pour diagnostiquer les broches Tx/Rx inversées sur le CC1101, obtenant enfin la capture et la relecture autonome de signaux 433 MHz sur un Pi 5.

OpenClawRadar
La négociation par incitation est faible : décrivez plutôt explicitement le comportement souhaité
Tips

La négociation par incitation est faible : décrivez plutôt explicitement le comportement souhaité

Une analyse Reddit montre que dire à Claude « ne sois pas bavard » ou « ne moralise pas » fonctionne à peine. Utilisez plutôt des instructions positives comme « réponds en 1 à 2 phrases » ou « donne-moi une réponse directe, considère les mises en garde comme facultatives ». Aussi, terminer par « merci ! » adoucit le ton.

OpenClawRadar
Cacher les lignes d'exécution d'OpenClaw dans les discussions Telegram : solution en une commande
Tips

Cacher les lignes d'exécution d'OpenClaw dans les discussions Telegram : solution en une commande

Empêchez OpenClaw de spammer les commandes exec brutes dans Telegram en définissant streaming.preview.toolProgress et streaming.progress.toolProgress sur false. Une seule commande Python sauvegarde la config, ajoute les clés, et un redémarrage rapide applique le correctif.

OpenClawRadar
Réduisez de 43% les tokens de Cut OpenClaw en affinant l'outil et les fichiers mémoire
Tips

Réduisez de 43% les tokens de Cut OpenClaw en affinant l'outil et les fichiers mémoire

Réduction des jetons de démarrage d'environ 9 457 à environ 5 400 (43 % de baisse) en convertissant TOOLS.md en un index, en déplaçant les détails des outils dans des fichiers séparés et en mettant en œuvre une promotion mémoire par étapes.

OpenClawRadar