French: Serveur MCP Local pour Claude Code avec Réduction de 98% des Tokens

Semble est un serveur MCP qui permet à Claude Code de rechercher efficacement dans les bases de code locales, en ne renvoyant que les extraits de code pertinents au lieu des fichiers complets. Il utilise un hybride d'embeddings statiques, BM25 et une pile de reclassement optimisée pour le code, le tout fonctionnant localement sur CPU — sans clés API, sans GPU, sans dépendances lourdes.
Installation
Installez via uvx :
claude mcp add semble -s user -- uvx --from "semble[mcp]" semble
Une fois installé, Claude Code peut rechercher n'importe quel dépôt — local ou distant — directement.
Détails clés
- Réduction des tokens : Utilise environ 98% de tokens en moins que l'approche typique grep+read.
- Performance : Indexe n'importe quel dépôt en ~250ms, répond aux requêtes en ~1.5ms (le tout sur CPU).
- Qualité : Atteint un NDCG@10 de 0,854 — 99% du meilleur hybride transformer testé, tout en étant environ 200 fois plus rapide.
- Comparé à : grepai, probe, colgrep et d'autres méthodes existantes.
- Open source : Disponible sur GitHub sous l'organisation MinishLab.
À qui cela s'adresse
Les développeurs utilisant Claude Code sur de grandes bases de code qui souhaitent réduire la consommation de tokens et la latence tout en obtenant des résultats de recherche de code de haute qualité sans appels API externes.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Un modèle pour exécuter Claude Code lors de sessions ininterrompues de nuit sans dérive
Un cadre en trois parties — exécuteur de chaîne, superviseur et un contrat de transfert unique — résout le problème de dérive de boucle de rétroaction dans les sessions autonomes Claude Code de plusieurs heures.

Career-Ops Fork Ajoute la Découverte d'Emplois LinkedIn via Apify
Un développeur a bifurqué le système career-ops Claude Code et a ajouté la découverte d'offres d'emploi LinkedIn via Apify, résolvant la principale limitation du projet original qui ne scannait que les pages carrières préconfigurées des entreprises.

10.33 t/s sur Qwen 3.5 35B avec un ordinateur portable à 300 $ : Répartition complète de l'optimisation
Un développeur atteint 10,33 t/s sur Qwen 3.5 35B Q4_K_S avec un Lenovo Ideapad Slim 3i à 300 $ en utilisant ik_llama.cpp, le core pinning, le décodage spéculatif MTP et un réglage BIOS des performances.

DecisionNode : CLI et serveur MCP pour le stockage sémantique de décisions
DecisionNode est un serveur CLI et MCP local qui stocke des décisions structurées au format JSON, les intègre sous forme de vecteurs pour la recherche sémantique et les rend accessibles à travers les outils d'IA via MCP. Il est sous licence MIT et conçu pour fonctionner avec Claude Code, Cursor, Windsurf, Antigravity et d'autres clients MCP.