Verwendung eines adversarialen Claude-Chats zur Erkennung von Kickoff-Mehrdeutigkeiten, bevor sie dich etwas kosten
Ein Entwickler auf r/ClaudeAI beschreibt einen Multi-Rollen-KI-Workflow, bei dem ein separater Claude-Chat als adversarieller Prüfer für Kickoffs fungiert, die an Claude Code gesendet werden. Das Setup deckte stille Fehler auf, wie z. B. geschweifte Anführungszeichen in HTML-Meta-Tags und Canon-Verstöße, die der primäre Architekt-Chat nach dem Sperren einer Regel erneut committed hatte.
In sechs Produktionsprojekten bemerkte der Autor, dass Claude Code entweder 2–4 klärende Fragen während der Ausführung stellte oder einen Abschlussbericht mit 4–8 Abweichungen von der Absicht zurückgab, einschließlich stiller Fehler, die erst später entdeckt wurden. Die Lösung: ein zweiter Claude-Chat, der mit dem Projekt-Canon (Voice-Dokumente, Projektstatus, gewonnene Erkenntnisse) und einem Protokoll ausgestattet ist, das ihn anweist, mehrdeutige Spezifikationen, fehlende Verifikationsschritte und stille Fehlermodi zu finden. Der Prüfer gibt ein Urteil in einem vorhersehbaren Format zurück: PASS, PASS-WITH-FLAGS oder FAIL.
Phasenergebnisse
- 9 Prüfschleusen während der Phase
- 2 FAILs, 4 PASS-WITH-FLAGS, 3 PASS
- Null sauberer First-Pass-PASS bei kundenorientierten Texten
- ~33 $ tatsächliche Claude Code API-Ausgaben
- Schätzungsweise 150–400 $ an Claude Code-Zeit gespart, indem Probleme vor der Ausführung erkannt wurden
ROI und Kosten
Auf Claude.ai Max 5x (100 $/Monat Pauschalgebühr) waren die Grenzkosten des adversariellen Prüfers praktisch null (nur Rate-Limit-Budget). Bei API-Preisen würde jedes Gate je nach Modell 0,06–0,90 $ kosten. Der ROI konzentriert sich auf die Executor-Seite (Claude Code), wo Wiederholungen als API-Ausgaben abgerechnet werden.
Die vier Rollen
- Director (Mensch): Besitzt das Projekt, entscheidet über Auslieferungen, schlichtet Streitigkeiten zwischen Architekt und Auditor
- Architect (Chat-KI): Entwirft Kickoffs, denkt nach, dokumentiert
- Executor (Claude Code): Erhält Kickoffs, führt aus, berichtet zurück
- Auditor (separater Chat-KI): Prüft Kickoffs und Abschlussberichte adversariell
Der Autor nennt diesen Workflow Calibrated Vibe Coding und veröffentlicht den Canon öffentlich unter github.com/kinestheticmarketing-stack/calibrated-design-canon. Die sofort nützlichsten Dateien sind METHODS/AUDITOR_PROTOCOL.md und METHODS/AUDITOR_PRIMING_TEMPLATE.md, mit denen Sie einen adversariellen Prüfer für Ihren nächsten wichtigen Kickoff einrichten können.
📖 Source: r/ClaudeAI
👀 Siehe auch

LLMock: HTTP-basierter Mocking-Server für deterministische LLM-Tests über Prozesse hinweg
LLMock ist ein echter HTTP-Server, der OpenAI-, Claude- und Gemini-APIs simuliert und Entwicklern ermöglicht, deterministische Tests über mehrere Prozesse hinweg auszuführen, ohne echte APIs anzusprechen. Er unterstützt SSE-Streaming, Tool-Aufrufe, Prädikat-Routing und Request-Protokollierung ohne Abhängigkeiten.

MCP-Server: Vergleich von lokalen und Cloud-LLMs mit Debattierfunktion
Der MCP-Server ermöglicht Entwicklern, lokale Modelle über Ollama neben verschiedenen Cloud-LLMs abzufragen, und bietet Funktionen wie einen Vergleich nebeneinander und eine strukturierte Debattenfunktion.

Omnara: Führe Claude Code und Codex von überall aus.
Omnara ist eine web- und mobile IDE, die Entwicklern das Ausführen und Interagieren mit Claude Code und Codex-Sitzungen von überall ermöglicht und Funktionen wie Cloud-Synchronisierung und einen Sprachagenten bietet.

Ante: Ein binärer Coding-Agent, der offline läuft
Ante ist ein eigenständiges Rust-Binary, das wie Claude Code oder Codex funktioniert, aber ohne Laufzeitabhängigkeiten und mit vollständiger Offline-Unterstützung. Es erreicht 82,7 % auf Terminal-Bench 2.1 mit DeepSeek V4 Flash.