MCP Slim : La recherche par intégration locale pour les outils MCP réduit l'encombrement du contexte

✍️ OpenClawRadar📅 Publié: April 17, 2026🔗 Source
MCP Slim : La recherche par intégration locale pour les outils MCP réduit l'encombrement du contexte
Ad

MCP Slim est un outil proxy qui résout le problème d'encombrement contextuel de MCP en remplaçant les catalogues complets d'outils par trois méta-outils : recherche, description et appel. Au lieu de charger toutes les définitions d'outils au préalable, le LLM recherche ce dont il a besoin, réduisant ainsi l'utilisation de la fenêtre contextuelle de 96%.

Détails clés

L'outil cible spécifiquement le problème documenté d'encombrement contextuel de MCP où la connexion de quelques serveurs peut consommer plus de 55 000 tokens sur les définitions d'outils avant le premier message. Le principal différentiateur de MCP Slim par rapport à d'autres proxys comme mcp-compressor et MCProxy est son utilisation de la recherche sémantique avec un modèle d'embedding MiniLM local. Cela lui permet de trouver des outils pertinents sans chevauchement de mots-clés - par exemple, "enregistrer une note" peut trouver create_entities.

L'outil fonctionne entièrement hors ligne et ne nécessite aucune clé API. Il fonctionne avec n'importe quel client MCP stdio, y compris Claude Desktop, Cursor, Cline, Windsurf et Zed.

Ad

Installation et configuration

L'installation se fait via : npx mcp-slim init

Le dépôt GitHub est disponible à l'adresse : https://github.com/dopatools/mcp-slim

L'auteur (/u/OpportunitySpare2441) s'est proposé de répondre aux questions concernant l'architecture ou les compromis.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

Exécution de Qwen3.6-35B-A3B-UD-Q5_K_XL en local avec VS Code Copilot sur AMD R9700
Tools

Exécution de Qwen3.6-35B-A3B-UD-Q5_K_XL en local avec VS Code Copilot sur AMD R9700

Un utilisateur partage sa configuration fonctionnelle de llama.cpp pour Qwen3.6-35B-A3B-UD-Q5_K_XL sur une seule AMD R9700 avec Vulkan, permettant de générer un site web complet et une suite de tests Playwright à partir de zéro avec un minimum d'incitations.

OpenClawRadar
Application de Bureau Claude Fonction de Collaboration Permet la Communication IA-à-IA via Google Docs Partagés
Tools

Application de Bureau Claude Fonction de Collaboration Permet la Communication IA-à-IA via Google Docs Partagés

Les utilisateurs de Claude ont réussi à mettre en œuvre une communication Claude-à-Claude en utilisant la nouvelle fonction de collaboration dans l'application de bureau, avec deux agents d'IA lisant et écrivant dans un Google Doc partagé lors d'un dialogue structuré en cinq échanges.

OpenClawRadar
🦀
Tools

Le projet HydraFusion de GitHub : orchestration multi-modèles pour un codage IA de qualité frontière

L'aperçu de recherche HydraFusion de GitHub Copilot orchestre plusieurs modèles par tâche, choisissant entre des flux de travail uniques, en cascade ou de critique. Les benchmarks montrent un gain de qualité de 4,9 points pour un coût inférieur de 67 % par rapport à Claude Opus 5.

OpenClawRadar
Memento v1.0 : Mémoire persistante locale pour les agents d'IA de codage
Tools

Memento v1.0 : Mémoire persistante locale pour les agents d'IA de codage

Memento v1.0 est une couche de mémoire entièrement locale pour les agents d'IA de codage qui exécute les embeddings, le stockage et la recherche sur votre machine sans dépendances cloud. Il utilise des embeddings all-MiniLM-L6-v2, l'indexation HNSW et prend en charge plusieurs IDE avec 17 outils MCP.

OpenClawRadar