Le serveur MCP en mode contexte réduit l'utilisation du contexte de code Claude de 98 %

Le mode Contexte est un serveur MCP qui s'intercale entre Claude Code et les sorties d'outils, réduisant la consommation de la fenêtre de contexte de 98 %. Au lieu de déverser des données brutes dans la fenêtre de contexte de 200K, il traite les sorties dans des sandboxs isolés.
Fonctionnement
Le système de sandbox lance des sous-processus isolés pour chaque appel d'exécution. Les scripts s'exécutent dans ces sous-processus avec leurs propres limites de processus, et seul stdout entre dans le contexte de la conversation. Les données brutes comme les fichiers journaux, les réponses API et les instantanés ne quittent jamais le sandbox.
Dix environnements d'exécution de langages sont disponibles : JavaScript, TypeScript, Python, Shell, Ruby, Go, Rust, PHP, Perl et R. Bun est détecté automatiquement pour une exécution JS/TS 3 à 5 fois plus rapide. Les CLI authentifiées (gh, aws, gcloud, kubectl, docker) fonctionnent via le passage d'identifiants où les sous-processus héritent des variables d'environnement et des chemins de configuration sans les exposer à la conversation.
Fonctionnalités de la base de connaissances
L'outil d'indexation segmente le contenu markdown par titres tout en conservant les blocs de code intacts, puis les stocke dans une table virtuelle SQLite FTS5. La recherche utilise le classement BM25 avec le stemming Porter appliqué au moment de l'indexation. Lorsque vous appelez la recherche, elle renvoie des blocs de code exacts avec leur hiérarchie de titres.
L'outil fetch_and_index étend cela aux URL : récupérer, convertir HTML en markdown, segmenter et indexer. La page brute n'entre jamais dans le contexte.
Benchmarks de performance
- Instantané Playwright : 56 Ko → 299 o
- Problèmes GitHub (20) : 59 Ko → 1,1 Ko
- Journal d'accès (500 requêtes) : 45 Ko → 155 o
- CSV analytique (500 lignes) : 85 Ko → 222 o
- Journal Git (153 commits) : 11,6 Ko → 107 o
- Recherche de dépôt (sous-agent) : 986 Ko → 62 Ko (5 appels contre 37)
Sur une session complète : 315 Ko de sortie brute deviennent 5,4 Ko. Le temps de session avant ralentissement passe d'environ 30 minutes à environ 3 heures. Contexte restant après 45 minutes : 99 % au lieu de 60 %.
Installation
Deux méthodes d'installation :
- Place de marché des plugins :
/plugin marketplace add mksglu/claude-context-modepuis/plugin install context-mode@claude-context-mode - MCP uniquement :
claude mcp add context-mode -- npx -y context-mode
Après l'installation, redémarrez Claude Code. Le mode Contexte inclut un crochet PreToolUse qui achemine automatiquement les sorties d'outils via le sandbox. Les sous-agents apprennent à utiliser batch_execute comme outil principal, et les sous-agents bash sont améliorés pour devenir polyvalents afin qu'ils puissent accéder aux outils MCP.
L'outil est open source sous licence MIT sur github.com/mksglu/claude-context-mode.
📖 Lire la source complète : HN LLM Tools
👀 See Also

L'outil de synchronisation de doc/contexte IA pour développeurs gagne en popularité après un post Reddit
Un développeur a partagé son outil de synchronisation de documentation et de contexte IA sur Reddit, ce qui a entraîné 1,1K téléchargements, 60 étoiles GitHub et 192 clones uniques en deux semaines après sa publication le 22 mars.

EsoLang-Bench : Un benchmark de codage utilisant des langages ésotériques pour tester le raisonnement des LLM
Des chercheurs ont créé EsoLang-Bench, un benchmark de codage utilisant des langages de programmation ésotériques comme Brainfuck et Whitespace pour tester si les LLM peuvent raisonner ou simplement faire du pattern-matching. Le meilleur résultat parmi GPT-5.2, O4-mini, Gemini, Qwen et Kimi était de 11,2 %.

Claude Mode Code Vocal : Conversations IA mains libres pour les développeurs
La version bêta du mode vocal de Claude vous permet de parler à l'IA et d'entendre ses réponses, avec des options mains libres et appuyer-pour-parler. Elle fonctionne sur le web et mobile, compte dans les limites d'utilisation habituelles, et permet de basculer entre texte et voix dans la même conversation.

Selfware : Framework d'agent IA local basé sur Rust avec architecture PDVR
Selfware est un framework d'agent IA open-source construit en Rust pour l'inférence locale, mettant en œuvre un cycle cognitif PDVR avec 54 outils intégrés et conçu pour des tâches de longue durée sur du matériel grand public.