Utilisateur de Reddit mesure la surcharge des tokens MCP : 67 000 tokens consommés avant toute question

Mesure de la surcharge de jetons MCP
Un développeur sur r/ClaudeAI a mesuré la surcharge de jetons de ses serveurs Model Context Protocol (MCP) et a constaté une consommation significative de contexte avant toute interaction utilisateur.
Principales conclusions de la mesure
Le développeur a rapporté :
- 67 000 jetons consommés avant même de poser une seule question
- Cela représente un tiers de sa fenêtre de contexte rien qu'en chargeant les définitions d'outils
- Playwright MCP seul utilisait 21 définitions d'outils (~13 600 jetons) à chaque session, qu'il utilise un navigateur ou non
- GitHub MCP utilisait ~18 000 jetons en veille
Approches alternatives avec une surcharge réduite
Le développeur a mis en œuvre des alternatives :
- Remplacé Playwright MCP par une compétence qui se charge à la demande, obtenant la même capacité avec environ 1/7e du coût de contexte
- Utilisé l'interface en ligne de commande GitHub (gh) au lieu de GitHub MCP, qui utilise ~200 jetons par commande au lieu de 18 000 jetons en veille
Comparaison entre les approches
Le développeur a noté que les compétences + outils CLI :
- Font le même travail que les serveurs MCP
- Ne consomment des jetons que lorsqu'ils sont réellement utilisés
- Les outils CLI se combinent entre eux d'une manière que les serveurs MCP ne peuvent pas
La mesure met en lumière le compromis entre commodité et efficacité de contexte lors de l'utilisation de serveurs MCP par rapport aux outils à la demande.
📖 Read the full source: r/ClaudeAI
👀 See Also
Intégration TTS xAI pour Home Assistant construite avec Claude — Répo complet
Un développeur a utilisé Claude pour créer une intégration Home Assistant personnalisée pour l'API TTS de xAI (voix Eve) avec une interface de configuration complète, cinq voix et des balises vocales.

docvault : Générez des documentations API locales pour réduire les hallucinations de l'IA
docvault est un outil qui génère des références d'API en markdown à partir du code source pour aider Claude et autres LLM à arrêter d'halluciner des signatures de fonctions. Il fonctionne pour les crates Rust et les packages Python, produit un fichier markdown à deux niveaux, et inclut un plugin Claude Code pour une utilisation sans intervention.

Indexes Persistants sur l'Extraction : Architecture pour un Serveur MCP YouTube
Un développeur partage des notes d'architecture pour la construction d'un serveur MCP YouTube qui utilise des index locaux persistants au lieu du modèle courant d'extraction-oubli.

Agent-Xray : Outil open-source pour déboguer les défaillances des agents IA à partir des journaux de traces
Agent-Xray est un outil open-source sous licence MIT qui analyse les journaux de traces des agents IA pour classer les échecs en catégories comme spin, tool_bug et early_abort, et inclut un mode d'application pour tester les correctifs contre des défis adverses.