Open-Source-Local-Hook schaltet Claude-Modelle automatisch um, um KI-Kosten zu senken

Ein Entwickler hat einen lokalen Hook quelloffen gemacht, der automatisch das kosteneffizienteste Claude-KI-Modell basierend auf der Art der Programmieraufgabe auswählt, was KI-Kosten um 50-70% reduzieren kann, ohne Qualitätseinbußen.
So funktioniert es
Das Tool läuft als lokaler Hook in Cursor und Claude Code (beide nutzen dasselbe Hook-System) bevor jeder Prompt gesendet wird. Es sitzt neben Opus/Plan und fungiert als effizienter Frontend-Filter, der offensichtlich schlechte Modellzuordnungen verhindert, bevor sie teure Modelle erreichen.
Wesentliche Funktionen
- Liest den Prompt und die aktuelle Modellauswahl
- Verwendet einfache Schlüsselwortregeln zur Aufgabenklassifizierung (Git-Operationen, Feature-Arbeit, Architektur/tiefgehende Analyse)
- Blockiert bei Überzahlung (z.B. Opus für Git-Commit) und schlägt Haiku oder Sonnet vor
- Blockiert bei Unterdimensionierung (Sonnet/Haiku für Architektur) und schlägt Opus vor
- Lässt alles andere unverändert durch
- !-Präfix umgeht den Filter vollständig bei Unstimmigkeiten mit dessen Vorschlag
Technische Details
- 3 Dateien: Bash + Python3 + JSON
- Kein Proxy, keine API-Aufrufe, keine externen Dienste
- Fail-Open-Design: bei Hängern läuft Claude Code normal weiter
- Quelloffen verfügbar unter: https://github.com/coyvalyss1/model-matchmaker
Leistung und Tests
Der Entwickler analysierte mehrere Wochen eigener Prompts und fand:
- 60-70% waren Standard-Feature-Arbeit, die Sonnet bewältigen konnte
- 5-20% waren Debugging/Fehlerbehebung
- Ein signifikanter Anteil waren reine Git/Umbenennungs/Formatierungsaufgaben, die Haiku identisch bei 90% geringeren Kosten bewältigt
Retrospektive Analysen zeigten, dass das Tool 50-70% der KI-Ausgaben ohne Qualitätsverlust reduziert hätte. Nach Feinabstimmung bewältigte es 12/12 echte Test-Prompts korrekt.
Gelöstes Problem
Das Problem ist nicht Wissen – Entwickler wissen, dass sie Modelle wechseln sollten – sondern Reibung. Im Flow-Zustand möchten Entwickler nicht über Dropdown-Menüs nachdenken. Dieses Tool automatisiert den Entscheidungsprozess.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

OpenClaw-Einrichtung auf Ubuntu UTM-VM mit LLM-API und Ollama-Zugriff
Ein Benutzer hat OpenClaw erfolgreich in einer abgeschotteten Ubuntu-VM auf einem M3 Mac konfiguriert, mit Zugriff auf lokales Ollama unter macOS und externe LLM-APIs wie Gemini, Claude und DeepSeek. Beispielkonfigurationsdateien und Fehlerbehebungsnotizen sind auf GitHub verfügbar.

Stoa Markets: Ein Marktplatz für GPUs und KI-Server mit verifizierten Angeboten
Stoa ist ein Marktplatz für den Kauf und Verkauf von neuen und gebrauchten GPUs und KI-Servern. Es standardisiert RFQs, verifiziert Geschäftspartner und bietet verbindliche Angebote, um die Preisfindung im GPU-Markt zu verbessern.

Google Workspace CLI enthält einen OpenClaw-Einrichtungsleitfaden in der Dokumentation
Googles neue gws-Dokumentation (Google Workspace CLI) erwähnt OpenClaw-Setup namentlich in einem eigenen Abschnitt für KI-Agenten-Fähigkeiten. Dies folgt auf aktuelle Diskussionen über Googles Überprüfung von Kontosperrungen für KI-Agenten.

Ssemble MCP Server ermöglicht es Claude, kurze Videos aus YouTube zu generieren
Ein neuer MCP-Server für Ssemble AI Clipping ermöglicht es Claude, TikTok/Reels/Shorts-artige Videos aus YouTube-URLs mit KI-generierten Clips, Untertitelvorlagen, Musiktracks und Overlays zu erstellen. Die Einrichtung umfasst das Hinzufügen einer Konfiguration zu Claude Desktop oder die Verwendung eines gehosteten Endpunkts.