Charger chaque serveur MCP à chaque invite détruit silencieusement le budget de tokens.

✍️ OpenClawRadar📅 Publié: May 2, 2026🔗 Source
Charger chaque serveur MCP à chaque invite détruit silencieusement le budget de tokens.
Ad

Un post sur r/ClaudeAI rapporte un problème subtil mais coûteux : lorsque plusieurs serveurs MCP sont configurés, chaque prompt les charge tous par défaut, même pour des requêtes triviales. L'utilisateur avait 5 à 6 serveurs et ne s'en est rendu compte qu'en vérifiant l'utilisation des tokens – les prompts brûlaient des tokens pour charger des définitions de serveurs non pertinentes à chaque fois.

Détails clés

  • Chaque prompt chargeait l'ensemble des serveurs MCP (5 à 6 serveurs).
  • Même les prompts simples (ex. "Quelle heure est-il ?") déclenchaient toutes les définitions de serveurs.
  • Solution : une couche de routage personnalisée qui sélectionne uniquement les serveurs pertinents pour le prompt.
  • Résultat : l'utilisation des tokens a considérablement diminué, et les temps de réponse des prompts se sont améliorés.
  • L'OP a admis "ne pas croire avoir laissé ça durer aussi longtemps sans vérifier".
Ad

Contexte technique

Les serveurs MCP (Model Context Protocol) sont des outils qui étendent les capacités de Claude (par exemple, accès au système de fichiers, requêtes de base de données, scraping web). Le comportement par défaut dans de nombreuses configurations – y compris les clients forké et les configurations manuelles – est d'envoyer la liste complète des définitions de serveurs avec chaque message. Cela signifie que les outils pour l'accès à la base de données, les E/S fichiers, la navigation web, etc., sont tous déversés dans la fenêtre de contexte avant que l'entrée réelle de l'utilisateur ne soit traitée.

Une couche de routage peut inspecter le message de l'utilisateur (ou le prompt système) et inclure conditionnellement uniquement les serveurs MCP dont les descriptions ou les outils correspondent à l'intention. Par exemple, un prompt mentionnant un chemin de fichier activerait les outils de fichier ; une question sur les cours boursiers ne chargerait que le serveur financier. Cela évite le surcoût en tokens des métadonnées de serveurs non pertinentes.

À qui cela s'adresse

Développeurs exécutant Claude avec plusieurs serveurs MCP, en particulier dans des pipelines automatisés ou des fronts personnalisés où l'efficacité des tokens est importante.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Comment réduire de 80 % les coûts de l'agent OpenClaw grâce au changement de modèle
Tips

Comment réduire de 80 % les coûts de l'agent OpenClaw grâce au changement de modèle

Un utilisateur a suivi l'utilisation des tokens pendant 14 jours et a constaté que 67% des dépenses concernaient des tâches où les modèles Flash bon marché égalent la qualité d'Opus. Passer à Flash par défaut et utiliser /model en cours de session a réduit les coûts d'environ 170 $ à environ 35 $ par mois.

OpenClawRadar
Claude Code Auto-audit trouve 3 Go de déchets dans ~/.claude — Voici comment le nettoyer
Tips

Claude Code Auto-audit trouve 3 Go de déchets dans ~/.claude — Voici comment le nettoyer

Un utilisateur a demandé à Claude Code d'auditer son propre répertoire ~/.claude et a trouvé 2,6 Go de transcripts de session obsolètes, 170 Mo de journaux de tentatives de télémétrie échouées et 153 Mo de tampons d'annulation — passant de 3 Go à moins de 200 Mo après le nettoyage.

OpenClawRadar
Application de la conformité des agents IA : approches basées sur le langage et les outils de démarrage
Tips

Application de la conformité des agents IA : approches basées sur le langage et les outils de démarrage

Un développeur partage des méthodes pratiques pour améliorer la conformité des agents IA, notamment en utilisant un langage négatif dans les amorces et en passant de règles souples à des outils codés en dur lorsque nécessaire.

OpenClawRadar
Automatisation Rentable d'OpenClaw : Utilisation des LLM Seulement en Cas de Besoin
Tips

Automatisation Rentable d'OpenClaw : Utilisation des LLM Seulement en Cas de Besoin

Un développeur partage une approche pratique pour utiliser OpenClaw pour des tâches déterministes sans appels constants à un LLM, créant des scripts Python pour des tâches cron et n'invoquant le LLM que lorsque des erreurs nécessitent une analyse et des corrections.

OpenClawRadar