ClawCodex /Beratungsmodus: Billigen Arbeiter mit teurem Prüfer kombinieren, um Kosten zu senken ohne Qualitätsverlust

✍️ OpenClawRadar📅 Veröffentlicht: 27. Mai 2026🔗 Source
ClawCodex /Beratungsmodus: Billigen Arbeiter mit teurem Prüfer kombinieren, um Kosten zu senken ohne Qualitätsverlust
Ad

Die meisten Agent-CLIs zwingen dich, ein einzelnes Modell zu wählen: Opus trifft gute Entscheidungen, aber sprengt dein Budget, während Haiku günstig ist, aber kritische Architekturentscheidungen verfehlt. ClawCodex, ein Open-Source-Python-Port von Claude Code, löst dies mit einem /advisor-Modus, der ein günstiges Worker-Modell mit einem teuren Reviewer-Modell an wichtigen Entscheidungspunkten kombiniert.

Wie es funktioniert

Der günstige Worker (z. B. haiku-4-5, deepseek-v4-pro) erledigt die Hauptarbeit – Dateilesen, Bearbeitungen, Testläufe. An Entscheidungspunkten – bevor eine Interpretation übernommen wird, bevor eine Aufgabe als erledigt erklärt wird, oder bei Blockaden – pausiert der Worker und konsultiert einen stärkeren Reviewer (z. B. opus-4-7). Der Reviewer sieht die gesamte Konversation (jeden Tool-Aufruf, jedes Ergebnis) und gibt einen kurzen Lücken/Risiken/Als nächstes-Ratschlag zurück. Der Worker fährt dann fort.

Zwei Ausführungsmodi

  • Serverseitig (Anthropic 1P): Verwendet einen Advisor-Beta-Header – ein Roundtrip, Prompt-Cache-freundlich. Worker und Advisor laufen beide auf Anthropic.
  • Clientseitig (beliebiger Anbieter): Der Worker gibt ein reguläres tool_use aus, der Agent fängt es ab und führt einen separaten Aufruf zum konfigurierten Advisor-Modell durch. Zwei Roundtrips, aber du kannst Anbieter mischen – z. B. DeepSeek Worker + Claude Opus Advisor, oder Gemini Worker + GLM Advisor.
Ad

Konfiguration & Überwachung

Die Konfiguration erfolgt mit einer einzigen Zeile im REPL:

/advisor anthropic:claude-opus-4-7
/advisor deepseek:deepseek-v4-pro

Die Statusleiste zeigt Worker-Token, Advisor-Token und USD-Kosten separat an, sodass du genau siehst, wohin dein Budget fließt.

Benchmarks & Kompatibilität

ClawCodex unterstützt nativ Anthropic, OpenAI, Gemini, DeepSeek, GLM, Minimax und OpenRouter. Auf SWE-bench Verified erreicht der Agent 58,2% mit Gemini 2.5 Pro, verglichen mit OpenClaudes 53% unter derselben Testumgebung.

Der schwierige Teil: Prompts

Die kniffligste technische Herausforderung war zu verhindern, dass der Advisor einfach den Plan des Workers wiederholt – frühe Versionen verschwendeten Kontext mit wortwörtlichen Wiederholungen. Die Lösung war eine strenge „Keine Ich-Perspektive, keine Wiederholungen“-Regel kombiniert mit der Lücken/Risiken/Als nächstes-Vorlage.

Für wen es gedacht ist

Entwickler, die KI-Coding-Agenten nutzen und Architektururteile auf Opus-Niveau wünschen, ohne Opus-Preise für jeden einzelnen Aufruf zu zahlen.

📖 Lies die vollständige Quelle: r/openclaw

Ad

👀 Siehe auch

NerfGuard: Ein Klassifikator, der Codierungsanfragen an günstigere Modelle weiterleitet und die Kosten um das Dreifache senkt
Werkzeuge

NerfGuard: Ein Klassifikator, der Codierungsanfragen an günstigere Modelle weiterleitet und die Kosten um das Dreifache senkt

NerfGuard verwendet einen schnellen Klassifizierer, um Anfragen von Codierungsagenten an das günstigste Modell und die erforderliche Reasoning-Tiefe weiterzuleiten, was eine dreifache Nutzung bei gleichen Kosten ermöglicht. Inklusive Token-Optimierungen.

OpenClawRadar
Gemma-4 26B-A4B mit Opencode läuft effizient auf dem M5 MacBook Air
Werkzeuge

Gemma-4 26B-A4B mit Opencode läuft effizient auf dem M5 MacBook Air

Ein 32GB M5 MacBook Air kann das Gemma-4-26B-A4B-it-UD-IQ4_XS-Modell mit 300 Token/Sekunde bei der Eingabeverarbeitung und 12 Token/Sekunde bei der Generierung im Energiesparmodus ausführen, wobei es nur 8W Leistung verbraucht, ohne warm oder laut zu werden.

OpenClawRadar
🦀
Werkzeuge

Claude Code v2.1.239: Kostenschätzungen beinhalten 1,1-fachen Aufschlag, /claude-api-Upgrade und wichtige Korrekturen

Claude Code v2.1.239 fügt den USA-spezifischen Inferenz-Aufschlag zu Kostenschätzungen hinzu, führt das /claude-api-Upgrade für Python 1.x ein und behebt Bedrock-Proxy, WebFetch-Speicher und mehr.

OpenClawRadar
Claude-Code v2.1.63 fügt HTTP-Hooks, Slash-Befehle hinzu und behebt Speicherlecks
Werkzeuge

Claude-Code v2.1.63 fügt HTTP-Hooks, Slash-Befehle hinzu und behebt Speicherlecks

Claude-Code v2.1.63 führt HTTP-Hooks für JSON-basierte externe Aufrufe ein, fügt die Slash-Befehle /simplify und /batch hinzu und behebt mehrere Speicherlecks in lang laufenden Sitzungen. Das Release verbessert außerdem die MCP-Server-Verwaltung und die VSCode-Integration.

OpenClawRadar