Acheminer Claude Code via Ollama et réduire votre facture d'environ 90%

Ce repo de Coherence Daddy propose une configuration complète pour router les sessions terminal de Claude Code via une instance Ollama locale, tout en gardant Claude Desktop sur le niveau payant Pro d'Anthropic. Résultat : une réduction annoncée d'environ 90 % des coûts d'API de Claude Code.
Comment ça marche
Vous exécutez deux moteurs côte à côte :
- Claude Desktop (Anthropic) – utilisé pour la stratégie, l'architecture, la revue de code et les bugs complexes.
- Claude Code → Ollama – utilisé pour les lints, refactorisations, modifications répétitives, opérations par lots sur fichiers et tâches de recherche-remplacement. Tourne sur un modèle open-source gratuit (Gemma, Qwen, DeepSeek, au choix).
Processus de configuration
Le repo inclut une présentation HTML autonome (21 diapositives) avec une invite copier-coller qui effectue environ 98 % de la configuration automatiquement. Elle détecte votre OS (macOS, Windows + WSL2, Linux), installe tout, configure le routeur et vérifie les deux moteurs à la fin.
Pour exécuter localement :
git clone https://github.com/Coherence-Daddy/use-ollama-to-enhance-claude.git
cd use-ollama-to-enhance-claude/presentation
open index.html # macOS, ou glisser-déposer dans le navigateurOu utilisez directement l'invite copier-coller depuis prompts/copy-paste-prompt.md.
Structure du dépôt
prompts/copy-paste-prompt.md– l'invite de configuration.presentation/index.html– le deck visuel complet (aucune étape de build nécessaire).- Également hébergé sur coherencedaddy.com/tutorials/use-ollama-to-enhance-claude.
Pourquoi ça existe
Claude Pro sur le bureau est génial pour la réflexion et l'architecture, mais Claude Code dans le terminal consomme rapidement le quota sur les tâches gourmandes en contexte. Router ces tâches via Ollama (modèles gratuits locaux ou hébergés dans le cloud) conserve la même expérience utilisateur mais à une fraction du coût.
Licence
MIT – libre d'utilisation, de fork ou de remix.
📖 Lire la source complète : HN AI Agents
👀 See Also

Comment migrer OpenClaw et Hermes entre des machines via une auto-migration SSH
Un utilisateur a transféré OpenClaw et Hermes de WSL2 Ubuntu sur un ordinateur portable vers une instance EVO-X2 WSL2 Ubuntu 2604 en faisant en sorte que les outils se connectent en SSH et migrent eux-mêmes.

Mise à l'échelle du codage agentique à plus de 150 PR/semaine : leçons tirées de 85 000 $ de jetons chez Lovable
Alexander Lebedev raconte comment il est passé de 20 à 30 PR/semaine avec un humain à plus de 150 PR/semaine avec une nuée d'agents IA, dépensant 85 000 $ en tokens depuis janvier. Principaux enseignements : classification des risques, revue IA remplaçant la revue humaine, et le défi de préserver la diffusion des connaissances.

Analyse du plugin de mémoire OpenClaw : Lossless Claw + LanceDB recommandé
Un développeur a testé les plugins de mémoire OpenClaw et a constaté que la configuration par défaut provoque un gonflement des tokens, tandis que Lossless Claw associé à LanceDB offre des performances optimales pour maintenir le contexte de l'agent sans coûts élevés.

Construction d'un assistant multi-agent entièrement local avec OpenClaw et Ollama
Un développeur partage sa pile pour un assistant IA personnel entièrement local utilisant OpenClaw et Ollama, incluant les modèles qwen3.5:35b-a3b, gemma3:4b, mistral:7b, des serveurs MCP pour Home Assistant et Gmail, ainsi qu'une interface Telegram Bot.