Acheminer Claude Code via Ollama et réduire votre facture d'environ 90%

✍️ OpenClawRadar📅 Publié: April 27, 2026🔗 Source
Acheminer Claude Code via Ollama et réduire votre facture d'environ 90%
Ad

Ce repo de Coherence Daddy propose une configuration complète pour router les sessions terminal de Claude Code via une instance Ollama locale, tout en gardant Claude Desktop sur le niveau payant Pro d'Anthropic. Résultat : une réduction annoncée d'environ 90 % des coûts d'API de Claude Code.

Comment ça marche

Vous exécutez deux moteurs côte à côte :

  • Claude Desktop (Anthropic) – utilisé pour la stratégie, l'architecture, la revue de code et les bugs complexes.
  • Claude Code → Ollama – utilisé pour les lints, refactorisations, modifications répétitives, opérations par lots sur fichiers et tâches de recherche-remplacement. Tourne sur un modèle open-source gratuit (Gemma, Qwen, DeepSeek, au choix).

Processus de configuration

Le repo inclut une présentation HTML autonome (21 diapositives) avec une invite copier-coller qui effectue environ 98 % de la configuration automatiquement. Elle détecte votre OS (macOS, Windows + WSL2, Linux), installe tout, configure le routeur et vérifie les deux moteurs à la fin.

Pour exécuter localement :

git clone https://github.com/Coherence-Daddy/use-ollama-to-enhance-claude.git
cd use-ollama-to-enhance-claude/presentation
open index.html  # macOS, ou glisser-déposer dans le navigateur

Ou utilisez directement l'invite copier-coller depuis prompts/copy-paste-prompt.md.

Ad

Structure du dépôt

Pourquoi ça existe

Claude Pro sur le bureau est génial pour la réflexion et l'architecture, mais Claude Code dans le terminal consomme rapidement le quota sur les tâches gourmandes en contexte. Router ces tâches via Ollama (modèles gratuits locaux ou hébergés dans le cloud) conserve la même expérience utilisateur mais à une fraction du coût.

Licence

MIT – libre d'utilisation, de fork ou de remix.

📖 Lire la source complète : HN AI Agents

Ad

👀 See Also

Comment migrer OpenClaw et Hermes entre des machines via une auto-migration SSH
Guides

Comment migrer OpenClaw et Hermes entre des machines via une auto-migration SSH

Un utilisateur a transféré OpenClaw et Hermes de WSL2 Ubuntu sur un ordinateur portable vers une instance EVO-X2 WSL2 Ubuntu 2604 en faisant en sorte que les outils se connectent en SSH et migrent eux-mêmes.

OpenClawRadar
Mise à l'échelle du codage agentique à plus de 150 PR/semaine : leçons tirées de 85 000 $ de jetons chez Lovable
Guides

Mise à l'échelle du codage agentique à plus de 150 PR/semaine : leçons tirées de 85 000 $ de jetons chez Lovable

Alexander Lebedev raconte comment il est passé de 20 à 30 PR/semaine avec un humain à plus de 150 PR/semaine avec une nuée d'agents IA, dépensant 85 000 $ en tokens depuis janvier. Principaux enseignements : classification des risques, revue IA remplaçant la revue humaine, et le défi de préserver la diffusion des connaissances.

OpenClawRadar
Analyse du plugin de mémoire OpenClaw : Lossless Claw + LanceDB recommandé
Guides

Analyse du plugin de mémoire OpenClaw : Lossless Claw + LanceDB recommandé

Un développeur a testé les plugins de mémoire OpenClaw et a constaté que la configuration par défaut provoque un gonflement des tokens, tandis que Lossless Claw associé à LanceDB offre des performances optimales pour maintenir le contexte de l'agent sans coûts élevés.

OpenClawRadar
Construction d'un assistant multi-agent entièrement local avec OpenClaw et Ollama
Guides

Construction d'un assistant multi-agent entièrement local avec OpenClaw et Ollama

Un développeur partage sa pile pour un assistant IA personnel entièrement local utilisant OpenClaw et Ollama, incluant les modèles qwen3.5:35b-a3b, gemma3:4b, mistral:7b, des serveurs MCP pour Home Assistant et Gmail, ainsi qu'une interface Telegram Bot.

OpenClawRadar