Réduisez de 90 % les coûts des sessions de codage IA avec l'indexation de code basée sur des graphes

Un utilisateur de Reddit rapporte dépenser 2 à 6 dollars par requête sur Claude Code, car le modèle relit des dizaines de fichiers à chaque session. Même avec la mise en cache (70 % des tokens provenant du cache avec 90 % de réduction), le cache se réinitialise à chaque session. La solution : un serveur local qui indexe le codebase dans une base de données graphe, interrogée via le Model Context Protocol (MCP) au lieu de lectures brutes de fichiers.
Comment ça marche
- Au lieu d'analyse AST ou d'embeddings vectoriels, l'outil utilise un LLM pour générer un objectif, un résumé et un contexte métier pour chaque fichier, ainsi que des liens vers ses fonctions, classes et imports.
- Le graphe est exposé via un serveur MCP ; Claude interroge le graphe pour des recherches ciblées (2 à 4 nœuds par question) au lieu de vider l'intégralité du dépôt dans le contexte.
- Les coûts de session sont passés de dollars à centimes. L'approche fonctionne aussi bien avec des modèles open-source comme DeepSeek-V4 et Kimi-2.6, car c'est la récupération (et non la taille du modèle) qui fait le gros du travail.
Détails de configuration
Tout s'exécute localement, mono-tenant, sans dépendance cloud. Le projet est open-sourcé sur GitHub : github.com/ByteBell/bytebell-oss. L'utilisateur note qu'il n'utilise pas d'analyse AST ou de vecteurs — le graphe est constitué d'analyses de fichiers générées par LLM.
À qui cela s'adresse
Les développeurs utilisant Claude Code (ou tout agent IA facturé au token) sur de grands codebases qui souhaitent réduire les coûts en mettant en cache le contexte structurel entre sessions.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

AgenticStore MCP : Boîte à outils Python pour Claude Desktop avec 27 outils locaux
AgenticStore MCP est une boîte à outils Python open-source qui remplace plusieurs serveurs MCP par une seule installation, offrant à Claude Desktop 27 outils locaux incluant une mémoire persistante, une recherche web et un audit de dépôt, sans nécessiter de configuration Docker ou Node.js.

Ghostbar : un client IA Swift natif macOS d'environ 5 Mo qui se cache du partage d'écran
Ghostbar est un client IA natif Swift pour la barre de menus macOS (~5 Mo) qui utilise window.sharingType = .none pour devenir invisible aux enregistreurs d'écran. Fonctionne avec Ollama, vLLM, llama.cpp et tout backend compatible OpenAI.

Reformuler la commande slash pour Claude Code applique une technique de sciences cognitives à la résolution de problèmes
Un développeur a créé une commande slash /reframe pour Claude Code qui met en œuvre une technique de science cognitive appelée oscillation distance-engagement. L'approche a été testée sur trois LLM open-weight avec 50 problèmes et a systématiquement surpassé les autres méthodes.

Claude Banana : Un plugin Claude Code pour la génération d'images avec prise en compte du système de design
Claude Banana est un plugin Claude Code qui génère des images en utilisant l'API Gemini de Google avec une création d'invites contextuelle. Il lit les configurations Tailwind, les variables CSS, les jetons de conception et les ressources existantes pour comprendre les styles visuels du projet.