Charger chaque serveur MCP à chaque invite détruit silencieusement le budget de tokens.

✍️ OpenClawRadar📅 Publié: May 2, 2026🔗 Source
Charger chaque serveur MCP à chaque invite détruit silencieusement le budget de tokens.
Ad

Un post sur r/ClaudeAI rapporte un problème subtil mais coûteux : lorsque plusieurs serveurs MCP sont configurés, chaque prompt les charge tous par défaut, même pour des requêtes triviales. L'utilisateur avait 5 à 6 serveurs et ne s'en est rendu compte qu'en vérifiant l'utilisation des tokens – les prompts brûlaient des tokens pour charger des définitions de serveurs non pertinentes à chaque fois.

Détails clés

  • Chaque prompt chargeait l'ensemble des serveurs MCP (5 à 6 serveurs).
  • Même les prompts simples (ex. "Quelle heure est-il ?") déclenchaient toutes les définitions de serveurs.
  • Solution : une couche de routage personnalisée qui sélectionne uniquement les serveurs pertinents pour le prompt.
  • Résultat : l'utilisation des tokens a considérablement diminué, et les temps de réponse des prompts se sont améliorés.
  • L'OP a admis "ne pas croire avoir laissé ça durer aussi longtemps sans vérifier".
Ad

Contexte technique

Les serveurs MCP (Model Context Protocol) sont des outils qui étendent les capacités de Claude (par exemple, accès au système de fichiers, requêtes de base de données, scraping web). Le comportement par défaut dans de nombreuses configurations – y compris les clients forké et les configurations manuelles – est d'envoyer la liste complète des définitions de serveurs avec chaque message. Cela signifie que les outils pour l'accès à la base de données, les E/S fichiers, la navigation web, etc., sont tous déversés dans la fenêtre de contexte avant que l'entrée réelle de l'utilisateur ne soit traitée.

Une couche de routage peut inspecter le message de l'utilisateur (ou le prompt système) et inclure conditionnellement uniquement les serveurs MCP dont les descriptions ou les outils correspondent à l'intention. Par exemple, un prompt mentionnant un chemin de fichier activerait les outils de fichier ; une question sur les cours boursiers ne chargerait que le serveur financier. Cela évite le surcoût en tokens des métadonnées de serveurs non pertinentes.

À qui cela s'adresse

Développeurs exécutant Claude avec plusieurs serveurs MCP, en particulier dans des pipelines automatisés ou des fronts personnalisés où l'efficacité des tokens est importante.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Les agents travailleurs ne devraient pas écrire directement la mémoire : un modèle Curateur-Agent
Tips

Les agents travailleurs ne devraient pas écrire directement la mémoire : un modèle Curateur-Agent

Un post Reddit détaille un pattern Memory Curator qui empêche les agents workers d'écrire directement dans la mémoire partagée, en routant les événements via une couche de validation et de cadrage.

OpenClawRadar
Top 5 compétences moins évidentes d'agent pour les développeurs frontend utilisant Claude AI
Tips

Top 5 compétences moins évidentes d'agent pour les développeurs frontend utilisant Claude AI

Un développeur frontend partage 5 compétences spécifiques pour les agents Claude AI qui améliorent la productivité et la qualité du code : Playwright, Types avancés pour TypeScript, LyteNyte Grid, Modèles Tailwind CSS et Compétences PNPM.

OpenClawRadar
Gaspillage de tokens dans Claude Code : Un auto-audit utilisateur montre que les corrections comportementales surpassent le changement de modèle
Tips

Gaspillage de tokens dans Claude Code : Un auto-audit utilisateur montre que les corrections comportementales surpassent le changement de modèle

Un utilisateur a mesuré l'utilisation des tokens dans Claude Code et a découvert que /clear entre les tâches, la planification avant l'édition et l'interdiction de relecture des fichiers modifiés permettaient d'économiser plus de tokens que le changement de modèle. La discipline pratique bat les wrappers.

OpenClawRadar
Claude CLI v2.1.154 brise le vLLM local — un correctif d'une ligne le répare
Tips

Claude CLI v2.1.154 brise le vLLM local — un correctif d'une ligne le répare

Claude CLI ≥2.1.154 ajoute trois nouveaux rôles API (ctx, msg, system) qui cassent la compatibilité avec les serveurs vLLM locaux. Un correctif d'une ligne dans le protocole Anthropic de vLLM rétablit la compatibilité.

OpenClawRadar