Behandlung von Agentendurchläufen als Überprüfungspakete: Ein praktisches Muster für Claude Code & Codex

Ein Reddit-Nutzer, der mit Codex/Claude-artigen Agenten-Workflows experimentiert, teilt ein Muster, das seine Ergebnisse verbessert hat: Anstatt Agentenläufe als Chat-Transkripte zu behandeln, erstellen sie nun einen dauerhaften Ordner mit mehreren Artefakten, die von einem anderen Menschen oder Agenten überprüft werden können.
Wichtige Artefakte pro Lauf
research.md— Quellen und Annahmen, die der Agent verwendet hatdrafts.md— Kandidaten-Ausgaben, einschließlich abgelehnterevals.md— Bewertungsrubrik und Begründung für die gewählte Optionapproval-packet.md— Kontrollpunkt vor dem irreversiblen Schrittmetrics.json— numerische Ergebnisse des Laufsmemory.md— nur wiederverwendbare Workflow-Lektionen
Zwei große Lektionen
Das Gedächtnis sollte sich darauf konzentrieren, wie man arbeitet, nicht auf eine ungeprüfte Fakten-Datenbank. Wenn eine Behauptung wichtig ist, gehört sie in ein überprüftes Artefakt mit einer Quelle.
„Vollständig autonom“ ist weniger nützlich als „autonom bis zum irreversiblen Schritt“. Für Code bedeutet das Commit/Deploy. Für Inhalte bedeutet das Veröffentlichen. Für lokale Workflows bedeutet das alles, was Anmeldeinformationen oder Konten Dritter betrifft.
Warum das hilft
Fehler werden in bestimmten Phasen sichtbar: War die Recherche falsch? War der Entwurf schlecht? War die Bewertungsrubrik zu vage? Hat das Freigabepaket ein Risiko übersehen? Hat das Gedächtnis eine Lektion gespeichert, die beim nächsten Mal tatsächlich geholfen hat? Dies macht Iterationen schneller und zielgerichteter, als sich auf Chat-Transkripte zu verlassen.
Der Beitrag ist ein Diskussionsanstoß – der Autor ist neugierig, ob andere dauerhafte Artefakte verwenden oder Chat-Transkripten für Claude Code/Codex-Workflows vertrauen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

CLAUDE.md verwenden, um Projektkonventionen über Claude AI-Sitzungen hinweg beizubehalten
Fügen Sie eine CLAUDE.md-Datei in Ihr Projektstammverzeichnis ein, und Claude liest sie zu Beginn jeder Sitzung. Es merkt sich Ihre TypeScript-Regeln, keine Standard-Exporte, Testkonventionen und Architekturkontext, ohne dass Sie alles neu erklären müssen.

Überprüfung auf ungenutzte Codex-Reset-Guthaben über mehrere ChatGPT-Konten hinweg via OpenClaw
Ein Benutzer stellte fest, dass Rate-Limit-Reset-Guthaben auf einem zweiten OAuth-Konto abliefen. Der Agent scannte beide Konten und fand insgesamt 6 ungenutzte Credits. Eines wurde eingelöst, um die Abklingzeit in unter einer Minute zu löschen. Zu den Fallstricken gehören undokumentierte Endpunkte und Probleme bei der Skill-Erkennung.

CLAUDE.md-Einträge, die das menschliche Tempoverhalten von Opus 4.7 deaktivieren
Drei CLAUDE.md-Direktiven, die Claude 4.7 Opus davon abhalten, Pausen vorzuschlagen, Zeitüberschätzungen zu liefern und Aufgaben in Phasen aufzuteilen – während langer Codierungssitzungen.

11 tiefgründige Claude-Tipps eines täglichen Nutzers seit 18 Monaten
Ein Senior-Entwickler teilt 11 nicht offensichtliche Claude-Tipps nach 18 Monaten täglicher Nutzung, darunter Projects, Custom Styles, Memory, Sonnet 4.6 vs Opus 4.7, Haiku 4.5 für Batch-Arbeiten, Claude Code Subagents und Artifacts, die die API aufrufen.