Claude Code über Ollama leiten und Ihre Rechnung um ~90% senken

Dieses Repository von Coherence Daddy bietet eine komplette Einrichtung, um Claude Code-Terminalsitzungen über eine lokale Ollama-Instanz zu leiten, während Claude Desktop auf dem kostenpflichtigen Pro-Tarif von Anthropic bleibt. Das Ergebnis: eine behauptete ~90%ige Reduzierung der API-Kosten von Claude Code.
Wie es funktioniert
Sie betreiben zwei Engines parallel:
- Claude Desktop (Anthropic) – genutzt für Strategie, Architektur, Code-Reviews und knifflige Fehler.
- Claude Code → Ollama – genutzt für Lints, Refactorings, wiederholte Bearbeitungen, Batch-Dateioperationen und Grep-and-Replace-Aufgaben. Läuft auf einem kostenlosen Open-Source-Modell (Gemma, Qwen, DeepSeek, Ihrer Wahl).
Einrichtungsprozess
Das Repository enthält eine eigenständige HTML-Präsentation (21 Folien) mit einem Copy-Paste-Prompt, der ~98% der Einrichtung automatisch erledigt. Es erkennt automatisch Ihr Betriebssystem (macOS, Windows + WSL2, Linux), installiert alles, konfiguriert den Router und überprüft am Ende beide Engines.
Zur lokalen Ausführung:
git clone https://github.com/Coherence-Daddy/use-ollama-to-enhance-claude.git
cd use-ollama-to-enhance-claude/presentation
open index.html # macOS, oder in Browser ziehenOder verwenden Sie direkt den Copy-Paste-Prompt aus prompts/copy-paste-prompt.md.
Repository-Struktur
prompts/copy-paste-prompt.md– der Einrichtungsprompt.presentation/index.html– vollständiges visuelles Deck (kein Build-Schritt erforderlich).- Auch gehostet unter coherencedaddy.com/tutorials/use-ollama-to-enhance-claude.
Warum es das gibt
Claude Pro auf dem Desktop ist großartig für Denkarbeit und Architektur, aber Claude Code im Terminal verbraucht bei kontextintensiven Aufgaben schnell das Kontingent. Die Weiterleitung dieser Aufgaben über Ollama (lokal oder gehostete kostenlose Modelle) behält das gleiche Benutzererlebnis bei, jedoch zu einem Bruchteil der Kosten.
Lizenz
MIT – frei zur Nutzung, zum Forken oder Remixen.
📖 Lesen Sie die vollständige Quelle: HN AI Agents
👀 Siehe auch

Praktischer Leitfaden zum Self-Hosting Ihres ersten LLM
Ein Reddit-Beitrag erläutert Gründe für das Self-Hosting von LLMs, darunter Datenschutz für sensible Daten, Kostenvorhersagbarkeit für Agent-Workloads, Leistungsverbesserungen durch Wegfall von API-Roundtrips und Anpassungsmöglichkeiten durch Feinabstimmungsmethoden wie LoRA und QLoRA.

Workaround für den Zugriff auf OpenClaw Claude über die Claude Code CLI
Eine Methode leitet OpenClaw über die Claude Code CLI, um den Zugang zum Claude-Abonnement aufrechtzuerhalten, nachdem Anthropic direkte Drittanbieter-Schnittstellen blockiert hat. Der Prozess umfasst die Installation der CLI, die Einrichtung eines OAuth-Tokens und die Konfiguration von OpenClaw zur Verwendung des ACP-Plugins.

Korrektur für Unter-Agenten, die in OpenClaw v2026.3.13 nicht angezeigt werden
Eine Problemumgehung für OpenClaw v2026.3.13, bei der benutzerdefinierte Sub-Agenten nicht in der Agentenliste erscheinen: Vereinfachen Sie die openclaw.json-Agentenliste, sodass sie nur IDs enthält, und registrieren Sie Agenten manuell in runs.json mit dem Status 'idle'.

Leitfaden zur Einrichtung von Sicherheitsebenen für die Codierung mit Claude Code
Eine Schritt-für-Schritt-Anleitung zeigt, wie man Sicherheitsschichten nach dem Defense-in-Depth-Prinzip für die Programmierung mit Claude Code implementiert. Sie behandelt Pre-Commit-Hooks, CLAUDE.md-Dateien, lokale Review-Agenten, GitHub Actions CI und Branch-Protection.