Claude Code überträgt Codierung an Mistral/DeepSeek: 57M Tokens eingespart, 90-100 % Kostenreduktion

Der Entwickler pcx_wave veröffentlichte eine detaillierte Analyse von vibe-skill, einer Claude Code-Funktion, die Programmieraufgaben an günstigere Modelle (Mistral oder DeepSeek) delegiert, während Claude für die Planung und Überprüfung zuständig ist. Nach 10 Tagen und 254 Ausführungen wurden 57 Millionen Tokens eingespart und die Kosten um 90-100% gesenkt, bei gleichbleibender Claude-Qualität der Ergebnisse.
Wie es funktioniert
Vibe-skill läuft innerhalb von Claude Code. Du tippst /vibeon <was auch immer>, Claude zerlegt die Aufgabe und delegiert die eigentliche Codierung an ein leichtgewichtiges Modell (über das Open-Source-Tool Vibe). Anschließend überprüft Claude den Diff und korrigiert Fehler. Das günstige Modell verbraucht die Tokens; Claude gibt nur Tokens für Planung und Überprüfung aus.
Ergebnisse nach Modell
| Modell | Delegierte Tokens | Tatsächliche Kosten | Claude-Äquivalent | Einsparung |
|---|---|---|---|---|
| DeepSeek V4 Flash | 29M | 4,13 $ | 92,16 $ | 95% |
| Mistral Medium 3.5 | 28M | 0 $ (Pro-Abo) | 84,77 $ | 100% |
Gesamterfolgsquote: 98% bei 254 Ausführungen. Wenn die Delegierung fehlschlägt, erkennt und korrigiert Claude die Ausgabe.
Token-Ökonomie
Mistral-Tokens sind etwa 50% günstiger als die von Claude; DeepSeek-Tokens sind 95% günstiger. Der Autor nutzt ein Mistral Pro-Abo (18,36 $/Monat), das etwa 1 Milliarde kostenlose Tokens enthält. Für Mistral Pro-Abonnenten kostet die Delegierung 0 $, bis das Kontingent erschöpft ist; danach wird automatisch auf DeepSeek zurückgegriffen (da Mistral PAYG mit 1,52 $/M Tokens 10× teurer ist als DeepSeek).
Der Break-even-Punkt: DeepSeek allein ist günstiger als das Mistral Pro-Abo, wenn du weniger als 131M Tokens/Monat delegierst (18,36 $ / 0,14 $ pro M). Oberhalb dieses Volumens gewinnt Mistral Pro mit etwa 10× mehr Spielraum, bevor das Kontingent erreicht wird.
Einrichtung
Die Funktion ist Open Source unter github.com/pcx-wave/vibe-skill. Eine ähnliche Gemini-Funktion ist ebenfalls verfügbar, aber weniger konfigurierbar und instabil. Um sie zu nutzen, klone das Repository und lade die Funktion in Claude Code — dann einfach /vibeon für deine Aufgabe.
📖 Vollständige Quelle lesen: r/ClaudeAI
👀 Siehe auch

Claude Dispatch Beta: Einrichtungstipps und erste Eindrücke
Ein Entwickler teilt seine Erfahrungen mit der Einrichtung der Dispatch-Beta auf einem Mac Mini und hebt die Notwendigkeit einer konstanten Betriebsbereitschaft, spezifischer Erfolgskriterien und aggressiver Berechtigungen bei aktiviertem Computer Use hervor.

Auto Router vs Sonnet: Kosteneinsparungen vs Antwortqualität
Die Auto Router-Funktion von Open Router wählt LLMs dynamisch basierend auf der Kontextkomplexität aus und bietet erhebliche Kosteneinsparungen (0,8 Cent vs. 0,00071 Cent pro Anfrage), aber Nutzer berichten von einer verschlechterten Antwortqualität im Vergleich zu Sonnet 4.6.

Open-Source GTM-Plugin für Claude Code mit 166 Marketing-Skills und Bootstrap-Befehl
Ein Entwickler hat ein Open-Source-Go-To-Market-Plugin für Claude Code veröffentlicht, das 166 spezialisierte Marketing-Fähigkeiten in den Bereichen SEO, Content, Outbound, Sales, Growth, Analytics, Strategie, Ads, Social, CRM und KI-Suche bietet. Das Plugin enthält einen /bootstrap-Befehl, der Nutzer zu ihrer Marke befragt, um personalisierte Kontextdateien zu generieren.

Vier kostenlose Claude Code-Fähigkeiten für Prompt-Klarheit, Tutorials und Fehlerjagd
Vier Apache 2.0, kein kostenpflichtiger Tarif Claude Code Skills: Prompter (Prompt-Umschreibung), Tutorial-Creator (kommentierte Code-Durchgänge), Bug-Echo (Post-Fix Anti-Pattern-Suche) und Bug-Prospector (Pre-Release-Audit mit 7 Analyse-Perspektiven).