Kaltvalidierungsarchitektur: Dual-Agent-Code-Review-System als Open Source veröffentlicht

Cold Validation Architecture ist ein Open-Source-System, das eine Dual-Agent-Validierung für KI-generierten Code implementiert. Ein Agent schreibt den Code, während ein separater Agent ihn unabhängig prüft, ohne Zugriff auf die Überlegungen oder den Kontext des Erstellers zu haben.
Wie es funktioniert
Das System adressiert die Selbstprüfungsverzerrung bei Einzelagenten durch die Anwendung einer Aufgabentrennung ähnlich unabhängiger Audits. Der Prüfer arbeitet in vollständiger Isolation vom Denkprozess des Erstellers.
Arbeitsablaufphasen
- Plan schreiben →
/review-plan(Gate A) - Implementieren →
/review-impl(Gate C) - Ausliefern →
/acceptance-report(Gate D)
Wichtige Implementierungsdetails
- Der Prüfer läuft in einem isolierten temporären Verzeichnis
- Prüfer sieht nur: Plan-Dokument, Code-Diff und Testergebnis
- Ergebnisse bleiben mit Fingerabdrücken zur Nachverfolgung erhalten
- Ersteller kann der Begründung des Prüfers widersprechen
- Maximal 2 Runden pro Phase
- Erstellt mit Bash-Skripten und JSON-Schemata
- Funktioniert derzeit mit Claude Code + Codex CLI
- Muster ist agentenunabhängig (funktioniert mit verschiedenen KI-Agenten)
Technische Spezifikationen
Das System ist als Bash-Skripte implementiert, die zwischen zwei separaten KI-Agenten koordinieren. JSON-Schemata definieren die Struktur für Plan-Dokumente, Code-Überprüfungen und Abnahmeprotokolle. Die isolierte Ausführungsumgebung stellt sicher, dass der Prüfer keinen Zugriff auf die internen Überlegungen oder Zwischenschritte des Erstellers hat.
Dieser Ansatz ist nützlich für Entwickler, die eine strengere Validierung für KI-generierten Code implementieren möchten, insbesondere bei der Arbeit mit komplexen Systemen, bei denen die Selbstprüfung durch einen einzelnen Agenten Bestätigungsverzerrungen einführen könnte.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Forge: Open-Source Claude-Code-Plugin fügt Governance- und Test-Gates hinzu
Forge ist ein Open-Source-Claude-Code-Plugin, das Dateisperren, automatisierte Testgates und 22 Governance-Agenten hinzufügt, um Kollisionen und Abweichungen in KI-generierten Code-Workflows zu verhindern. Es ist unter der MIT-Lizenz lizenziert und wird über den Claude-Plugin-Marktplatz installiert.

Claude Codes Monitor-Tool leitet Entwicklerserver-Logs in KI-gesteuerte automatische Fehlerbehebungen
Mit dem Monitor-Tool von Claude Code können Sie einen Dev-Server im Hintergrund ausführen, Logs mit intelligenten Grep-Filtern durchsuchen und Claude Fehler automatisch erkennen, reparieren und committen lassen – während Sie die UI testen.

AgentMail-Gründer erläutert agentennatives Onboarding nachdem OpenClaw CAPTCHA-Block aufdeckte
AgentMail, eine E-Mail-API für KI-Agenten, hat seinen Onboarding-Prozess neu aufgebaut, nachdem sein eigener OpenClaw-Agent an einem Cloudflare-CAPTCHA gescheitert war. Das neue System bietet einen einzigen REST-Endpunkt für die programmatische Kontenerstellung, während Menschen für die Verifizierung im Prozess bleiben.

„Gefundene-Probleme“-Plugin protokolliert Fehler, die Claude bei anderen Aufgaben ignoriert
Ein Claude Code Plugin, das einzeilige Einträge in docs/found-issues.md schreibt, wenn der Agent Bugs außerhalb des Aufgabenbereichs entdeckt, mit automatischer Schließung bei PR-Merge und Tombstone-Erkennung.