Engramx v3.4 : Serveur MCP + Graphe de connaissances SQLite réduit de 89 % l'utilisation des tokens de Claude Code

Engramx v3.4 est un serveur MCP combiné à un graphe de connaissances basé sur SQLite qui intercepte les lectures de fichiers à la frontière de l'agent. Lorsque Claude Code tente de lire un fichier que engram a indexé, le hook renvoie un résumé structurel au lieu du contenu brut. Résultat : la même modification, le même diff, mais bien moins de tokens consommés par aller-retour.
Détails clés
- Benchmark : Base de code réelle de 87 fichiers ; réduction agrégée de 89,1 % des tokens. Dans le meilleur cas, un fichier est passé de 18 820 tokens à 306. Le script de benchmark est
bench/real-world.ts— vous pouvez l'exécuter sur n'importe quel projet qui vous appartient. - Support IDE : Fonctionne nativement avec 8 IDE : Claude Code (hooks + plugin officiel en cours de révision), Cursor (MDC + MCP + extension VS Code sur OpenVSX), Cline, Continue.dev, Aider, Windsurf, Zed et OpenAI Codex CLI. Une seule installation, un seul graphe, tous les outils en bénéficient.
- Local d'abord : La base de données SQLite se trouve dans
.engram/graph.dbdans votre dépôt. Rien ne quitte votre machine. Licence Apache 2.0. Aucun compte, aucune télémétrie. - Installation :
npm install -g engramxpuiscd ~/votre-projetetengram setup. Pour Cursor, exécutezcode --install-extension nickcirv.engram-vscode. - Suivi : La commande
engram costaffiche les économies de tokens par projet et par semaine. Après 24 heures d'utilisation normale, le résumé affiche des chiffres réels. - Prochaine v4.0 « Mesh + Spine » : Sortie le 25 mai. Couche de fédération optionnelle pour partager erreurs et ADR entre machines sans partager le code source. Phase 1 déjà fusionnée : identité ed25519, filtre PII à 14 catégories, 1007 tests.
L'outil répond directement au problème d'atteindre les limites Claude Code Max 5x en moins de 2 heures sur du travail réel — une seule requête complexe faisant passer le compteur de session de 21 % à 100 %.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

X-MCP 2.0 : Serveur MCP pour l'accès à l'API X/Twitter depuis Claude
X-MCP 2.0 est un serveur MCP qui connecte Claude Desktop et Claude Code à l'API X/Twitter v2 avec l'authentification OAuth 2.0 PKCE, offrant 10 outils pour publier des tweets, effectuer des recherches, obtenir des timelines, aimer, retweeter, répondre et consulter des profils.

La réutilisation du cache KV pour les conversations longues sur Apple Silicon offre une accélération de 200x
Un développeur a mis en œuvre la réutilisation du cache KV basé sur des sessions pour l'inférence LLM locale en utilisant le framework MLX d'Apple, obtenant une amélioration de 200x du temps jusqu'au premier token pour une longueur de contexte de 100K. L'approche conserve le cache KV en mémoire à travers les tours de conversation, ne traitant que les nouveaux tokens.
GLiGuard : Modèle de modération de sécurité open source de 300M paramètres revendiquant un gain de vitesse 16x par rapport aux garde-fous LLM
Fastino Labs publie GLiGuard, un modèle basé sur encodeur de 300 millions de paramètres qui effectue plusieurs tâches de sécurité en un seul passage, égalant ou dépassant des modèles 23 à 90 fois plus grands tout en étant jusqu'à 16 fois plus rapide.

Création d'un RAG agentic pour Obsidian avec Claude et d'un harnais d'évaluation pour détecter les hallucinations
Un développeur a construit un système RAG agentique sur un coffre Obsidian pour permettre à Claude de répondre à des questions issues de livres d'ingénierie, puis a créé un harnais d'évaluation utilisant Claude Sonnet comme juge pour détecter quand l'agent avait tort avec assurance. Des itérations de la grille d'évaluation ont amélioré l'accord juge-humain de 39 % à 94 %.