Verwendung eines adversarialen Claude-Chats zur Erkennung von Kickoff-Mehrdeutigkeiten, bevor sie dich etwas kosten

✍️ OpenClawRadar📅 Veröffentlicht: 12. Mai 2026🔗 Source
Ad

Ein Entwickler auf r/ClaudeAI beschreibt einen Multi-Rollen-KI-Workflow, bei dem ein separater Claude-Chat als adversarieller Prüfer für Kickoffs fungiert, die an Claude Code gesendet werden. Das Setup deckte stille Fehler auf, wie z. B. geschweifte Anführungszeichen in HTML-Meta-Tags und Canon-Verstöße, die der primäre Architekt-Chat nach dem Sperren einer Regel erneut committed hatte.

In sechs Produktionsprojekten bemerkte der Autor, dass Claude Code entweder 2–4 klärende Fragen während der Ausführung stellte oder einen Abschlussbericht mit 4–8 Abweichungen von der Absicht zurückgab, einschließlich stiller Fehler, die erst später entdeckt wurden. Die Lösung: ein zweiter Claude-Chat, der mit dem Projekt-Canon (Voice-Dokumente, Projektstatus, gewonnene Erkenntnisse) und einem Protokoll ausgestattet ist, das ihn anweist, mehrdeutige Spezifikationen, fehlende Verifikationsschritte und stille Fehlermodi zu finden. Der Prüfer gibt ein Urteil in einem vorhersehbaren Format zurück: PASS, PASS-WITH-FLAGS oder FAIL.

Phasenergebnisse

  • 9 Prüfschleusen während der Phase
  • 2 FAILs, 4 PASS-WITH-FLAGS, 3 PASS
  • Null sauberer First-Pass-PASS bei kundenorientierten Texten
  • ~33 $ tatsächliche Claude Code API-Ausgaben
  • Schätzungsweise 150–400 $ an Claude Code-Zeit gespart, indem Probleme vor der Ausführung erkannt wurden
Ad

ROI und Kosten

Auf Claude.ai Max 5x (100 $/Monat Pauschalgebühr) waren die Grenzkosten des adversariellen Prüfers praktisch null (nur Rate-Limit-Budget). Bei API-Preisen würde jedes Gate je nach Modell 0,06–0,90 $ kosten. Der ROI konzentriert sich auf die Executor-Seite (Claude Code), wo Wiederholungen als API-Ausgaben abgerechnet werden.

Die vier Rollen

  • Director (Mensch): Besitzt das Projekt, entscheidet über Auslieferungen, schlichtet Streitigkeiten zwischen Architekt und Auditor
  • Architect (Chat-KI): Entwirft Kickoffs, denkt nach, dokumentiert
  • Executor (Claude Code): Erhält Kickoffs, führt aus, berichtet zurück
  • Auditor (separater Chat-KI): Prüft Kickoffs und Abschlussberichte adversariell

Der Autor nennt diesen Workflow Calibrated Vibe Coding und veröffentlicht den Canon öffentlich unter github.com/kinestheticmarketing-stack/calibrated-design-canon. Die sofort nützlichsten Dateien sind METHODS/AUDITOR_PROTOCOL.md und METHODS/AUDITOR_PRIMING_TEMPLATE.md, mit denen Sie einen adversariellen Prüfer für Ihren nächsten wichtigen Kickoff einrichten können.

📖 Source: r/ClaudeAI

Ad

👀 Siehe auch

VectorClaw v1.0.0: MCP-Server zur Steuerung des Anki Vector Roboters
Werkzeuge

VectorClaw v1.0.0: MCP-Server zur Steuerung des Anki Vector Roboters

VectorClaw v1.0.0 ist ein MCP-Server, der es OpenClaw ermöglicht, Anki Vector-Roboter über 23 spezifische Werkzeuge für Sprache, Bewegung, Wahrnehmung, Sensoren und Display-Funktionen zu steuern.

OpenClawRadar
Steam City: Eine 3D-Pixel-Art-Karte deiner Steam-Bibliothek, erstellt mit Claude Code
Werkzeuge

Steam City: Eine 3D-Pixel-Art-Karte deiner Steam-Bibliothek, erstellt mit Claude Code

Ein Entwickler erstellte mit Claude Code Steam City, eine 3D-Pixelkunst-Visualisierung deiner Steam-Bibliothek. Spielstunden bestimmen die Gebäudehöhe, ungespielte Spiele bleiben dunkel. Bereits über 1.000 Spieler.

OpenClawRadar
KANBAII: Ein visuelles Kanban-Board, entwickelt mit Claude Code für KI-unterstützte Entwicklung
Werkzeuge

KANBAII: Ein visuelles Kanban-Board, entwickelt mit Claude Code für KI-unterstützte Entwicklung

Ein Entwickler hat KANBAII, ein lokales Kanban-Board-Tool, komplett mit Claude Code über zwei Monate hinweg erstellt. Es bietet visuelles Aufgabenmanagement, KI-Planung und parallele Ausführungsmodi für Claude-Code-Workflows.

OpenClawRadar
engram: Claude-Speicher-Plugin mit salienzgesteuertem Erfassen und Traumzyklen
Werkzeuge

engram: Claude-Speicher-Plugin mit salienzgesteuertem Erfassen und Traumzyklen

engram ist ein Claude-Speicher-Plugin, das Beobachtungen zur Erfassungszeit anhand von 5 Salienz-Dimensionen filtert und nur hoch bewertete Ereignisse in SQLite speichert, ohne LLM-Aufrufe für die Bewertung. Es verfügt über automatische Einbindung durch 5 Hooks und Traumzyklen, die wiederkehrende Arbeitsabläufe am Ende einer Sitzung extrahieren.

OpenClawRadar