4-Schichten-Selbstaudit-System für die Verhaltensentwicklung von OpenClaw

Ein Entwickler, der OpenClaw seit 6 Wochen als dauerhaften KI-Assistenten betreibt, identifizierte ein wiederkehrendes Problem: Claudes Selbstprüfung des eigenen Verhaltens erzeugte blinde Flecken, was zu wiederholten Fehlern führte, wie etwa das Deklarieren von Korrekturen als "erledigt" ohne Tests oder das Beschreiben geplanter Arbeiten mit derselben Zuversicht wie abgeschlossener Arbeiten.
Das 4-Schichten-Prüfsystem
Die Lösung ist ein 4-Schichten-System, das für Verhaltensentwicklung statt Modelltraining konzipiert ist. Die Gewichte ändern sich nicht, aber die Betriebsanweisungen werden durch diese Schichten intelligenter:
- Nachkorrektur-Verifizierung: Korrektur + Test + Nachweis als ein atomarer Schritt. Kein "korrigiert" ohne Beweis.
- Mustererkennung: Wöchentlicher Cron-Job, der das Fehlerprotokoll liest und nach Clustern sucht (gleicher Fehler 2+ Mal = Systemproblem).
- Externe Spiegelung: Sitzungszusammenfassungen an Gemini oder ein anderes LLM mit der Aufforderung "finde heraus, worauf dieser Assistent blind ist" senden. Unterschiedliche Architekturen erzeugen unterschiedliche blinde Flecken.
- Erwartung vs Realität: Tägliche Prüfung, um zu verifizieren, ob die "korrigierten" Punkte von gestern tatsächlich korrigiert blieben.
Ergebnisse und Implementierung
Im ersten echten Test fand Gemini 2 Muster, die Claude bei der Selbstprüfung völlig übersehen hatte. Beides waren echte Probleme, die aus dem System heraus nicht erkannt worden wären.
Das System enthält Sicherheitsvorkehrungen: menschliche Genehmigung für Verhaltensänderungen, geschützte Dateien, die tabu sind, und maximal 3 Korrekturen pro Zyklus. Der Code ist auf GitHub verfügbar unter https://github.com/oscarsterling/reasoning-loop.
📖 Read the full source: r/openclaw
👀 Siehe auch

Entwickler baut Open-Source-KI-Fähigkeit zur Validierung von Startup-Ideen und verwirft eigene Idee in 10 Minuten
Ein Entwickler hat eine Open-Source-KI-Fähigkeit namens startup-design erstellt, die durch 8 Phasen der Startup-Validierung führt, von der Ideenfindung bis zu den Finanzprognosen. Als er sie an seiner eigenen Startup-Idee testete, stellte die Fähigkeit schwierige Fragen, die zeigten, dass er nicht der richtige Gründer für dieses spezielle Konzept war.

RelayCode VS Code Extension leitet Claude-Code über souveräne RDUs weiter
OpenGPU hat RelayCode veröffentlicht, eine VS Code-Erweiterung, die als lokaler Proxy fungiert, um Claude Code- oder Copilot-Anfragen über ihr dezentrales Netzwerk zu Open-Weight-Modellen wie DeepSeek-R1 und MiniMax M2.5 weiterzuleiten, die auf souveränen rekonfigurierbaren Dataflow-Einheiten laufen.

Lokaler KI-Steuerberater mit verschlüsselten personenbezogenen Daten, basierend auf MCP
Ein Entwickler hat eine Steuererweiterung für Crow gebaut, die alle personenbezogenen Daten mit AES-256-GCM verschlüsselt und mit jedem MCP-kompatiblen Client funktioniert, einschließlich Claude, ChatGPT, Gemini oder lokalen Modellen über Ollama. Das System verarbeitet 1040, Schedule 1, HSA (8889), Bildungskredite (8863), selbstständige Tätigkeit (Schedule C/SE) und Kapitalgewinne (Schedule D) Berechnungen lokal.

Brand-Docs: Open-Source-Tool für Claude zum Erstellen von DOCX, PPTX, XLSX aus Vorlagen
Ein Reddit-Nutzer hat Brand-Docs als Open-Source-Lösung veröffentlicht, mit der Claude Office-Dokumente (DOCX, PPTX, XLSX) generieren kann, die Unternehmensvorlagen in Layout, Stilen und Bildern originalgetreu bewahren, ohne diese neu zu erstellen.