Réduire l'utilisation des jetons MCP en remplaçant les serveurs par des alternatives en ligne de commande

Optimisation des tokens par réduction des serveurs MCP
Un développeur a découvert que chaque serveur MCP ajouté à sa configuration déversait l'intégralité de son schéma d'outils dans la fenêtre de contexte à chaque message, consommant 30 à 40 % de son contexte disponible. Cela le faisait atteindre les limites de contexte plus rapidement que prévu.
Remplacements spécifiques MCP vers CLI
Après avoir audité sa configuration, il a identifié plusieurs serveurs MCP ayant des équivalents CLI et a effectué ces remplacements :
agentmail mcp → agentmail cli(installé vianpm install -g agentmail-cli) - permet à Claude de gérer la boîte de réception, d'envoyer des emails et de vérifier les messages via bashgithub mcp → gh cli- en utilisant des commandes commegh issue createetgh pr listpostgres mcp → psql- en utilisant des commandes commepsql -c "select * from users"
Serveurs MCP conservés dans la configuration
Deux serveurs MCP ont été conservés car ils manquaient de bonnes alternatives CLI :
- playwright mcp - pour les tâches d'automatisation de navigateur
- memory mcp - pour la fonctionnalité de mémoire persistante
Configuration résultante et règle
Le développeur a réduit son nombre de serveurs MCP de 6 à 2 tout en conservant toutes les fonctionnalités précédentes. Il a établi une nouvelle règle : "s'il y a un CLI, sautez le MCP. N'ajoutez des MCP que pour ce qui n'a vraiment pas d'option en ligne de commande." Ce changement a donné l'impression d'une fenêtre de contexte plus grande et a réduit la fréquence à laquelle il atteignait les limites.
📖 Read the full source: r/ClaudeAI
👀 See Also

Utiliser le HTML comme langage de chat principal pour les agents de codage IA afin de permettre les diagrammes SVG
Un développeur a changé les instructions système des agents de codage, passant du Markdown au HTML, permettant aux agents de générer des diagrammes SVG et des tableaux riches directement dans le chat. Utilisation de Qwen3.6-27B avec une interface HTML.

Graph Memory vs Markdown : pourquoi les fichiers plats deviennent une dette de prompt à grande échelle
Un développeur partage comment un système de mémoire en Markdown pour agents IA a grossi jusqu'à 80+ fichiers et 5 millions de caractères, transformant la récupération en jeu de devinettes. La solution : une mémoire en graphe avec nœuds et arêtes, pour que l'agent ne rende que le contexte pertinent par tâche.

Wtf.md et le rêve : deux concepts de workflow Claude qui méritent d'être explorés
Un développeur partage deux concepts pour Claude : Wtf.md pour stocker les erreurs de Claude, et Dreaming, l'idée de Karpathy pour la consolidation nocturne des sessions.

Exécuter un agent d'IA entièrement local sur un ordinateur portable avec 6 Go de VRAM : un guide étape par étape pour les étudiants
Découvrez comment les étudiants peuvent exploiter des ordinateurs portables avec 6 Go de VRAM pour exécuter des agents d'IA localement, sans dépendre d'API coûteuses. Notre guide décompose les étapes essentielles et les outils nécessaires.