Kaltvalidierungsarchitektur: Dual-Agent-Code-Review-System als Open Source veröffentlicht

✍️ OpenClawRadar📅 Veröffentlicht: 31. März 2026🔗 Source
Kaltvalidierungsarchitektur: Dual-Agent-Code-Review-System als Open Source veröffentlicht
Ad

Cold Validation Architecture ist ein Open-Source-System, das eine Dual-Agent-Validierung für KI-generierten Code implementiert. Ein Agent schreibt den Code, während ein separater Agent ihn unabhängig prüft, ohne Zugriff auf die Überlegungen oder den Kontext des Erstellers zu haben.

Wie es funktioniert

Das System adressiert die Selbstprüfungsverzerrung bei Einzelagenten durch die Anwendung einer Aufgabentrennung ähnlich unabhängiger Audits. Der Prüfer arbeitet in vollständiger Isolation vom Denkprozess des Erstellers.

Arbeitsablaufphasen

  • Plan schreiben/review-plan (Gate A)
  • Implementieren/review-impl (Gate C)
  • Ausliefern/acceptance-report (Gate D)

Wichtige Implementierungsdetails

  • Der Prüfer läuft in einem isolierten temporären Verzeichnis
  • Prüfer sieht nur: Plan-Dokument, Code-Diff und Testergebnis
  • Ergebnisse bleiben mit Fingerabdrücken zur Nachverfolgung erhalten
  • Ersteller kann der Begründung des Prüfers widersprechen
  • Maximal 2 Runden pro Phase
  • Erstellt mit Bash-Skripten und JSON-Schemata
  • Funktioniert derzeit mit Claude Code + Codex CLI
  • Muster ist agentenunabhängig (funktioniert mit verschiedenen KI-Agenten)
Ad

Technische Spezifikationen

Das System ist als Bash-Skripte implementiert, die zwischen zwei separaten KI-Agenten koordinieren. JSON-Schemata definieren die Struktur für Plan-Dokumente, Code-Überprüfungen und Abnahmeprotokolle. Die isolierte Ausführungsumgebung stellt sicher, dass der Prüfer keinen Zugriff auf die internen Überlegungen oder Zwischenschritte des Erstellers hat.

Dieser Ansatz ist nützlich für Entwickler, die eine strengere Validierung für KI-generierten Code implementieren möchten, insbesondere bei der Arbeit mit komplexen Systemen, bei denen die Selbstprüfung durch einen einzelnen Agenten Bestätigungsverzerrungen einführen könnte.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Forge: Open-Source Claude-Code-Plugin fügt Governance- und Test-Gates hinzu
Werkzeuge

Forge: Open-Source Claude-Code-Plugin fügt Governance- und Test-Gates hinzu

Forge ist ein Open-Source-Claude-Code-Plugin, das Dateisperren, automatisierte Testgates und 22 Governance-Agenten hinzufügt, um Kollisionen und Abweichungen in KI-generierten Code-Workflows zu verhindern. Es ist unter der MIT-Lizenz lizenziert und wird über den Claude-Plugin-Marktplatz installiert.

OpenClawRadar
Claude Codes Monitor-Tool leitet Entwicklerserver-Logs in KI-gesteuerte automatische Fehlerbehebungen
Werkzeuge

Claude Codes Monitor-Tool leitet Entwicklerserver-Logs in KI-gesteuerte automatische Fehlerbehebungen

Mit dem Monitor-Tool von Claude Code können Sie einen Dev-Server im Hintergrund ausführen, Logs mit intelligenten Grep-Filtern durchsuchen und Claude Fehler automatisch erkennen, reparieren und committen lassen – während Sie die UI testen.

OpenClawRadar
AgentMail-Gründer erläutert agentennatives Onboarding nachdem OpenClaw CAPTCHA-Block aufdeckte
Werkzeuge

AgentMail-Gründer erläutert agentennatives Onboarding nachdem OpenClaw CAPTCHA-Block aufdeckte

AgentMail, eine E-Mail-API für KI-Agenten, hat seinen Onboarding-Prozess neu aufgebaut, nachdem sein eigener OpenClaw-Agent an einem Cloudflare-CAPTCHA gescheitert war. Das neue System bietet einen einzigen REST-Endpunkt für die programmatische Kontenerstellung, während Menschen für die Verifizierung im Prozess bleiben.

OpenClawRadar
„Gefundene-Probleme“-Plugin protokolliert Fehler, die Claude bei anderen Aufgaben ignoriert
Werkzeuge

„Gefundene-Probleme“-Plugin protokolliert Fehler, die Claude bei anderen Aufgaben ignoriert

Ein Claude Code Plugin, das einzeilige Einträge in docs/found-issues.md schreibt, wenn der Agent Bugs außerhalb des Aufgabenbereichs entdeckt, mit automatischer Schließung bei PR-Merge und Tombstone-Erkennung.

OpenClawRadar