Rekursiver Selbstverbesserungsrahmen für KI-Codierungsagenten mit Claude Code

✍️ OpenClawRadar📅 Veröffentlicht: 28. März 2026🔗 Source
Rekursiver Selbstverbesserungsrahmen für KI-Codierungsagenten mit Claude Code
Ad

Ein Entwickler hat ein Framework open-source gestellt, das KI-Coding-Agenten ermöglicht, sich selbst rekursiv mit Claude Code zu verbessern. Das System wurde nach monatelanger Forschung darüber entwickelt, wie Modellanbieter rekursive Agentenoptimierung implementieren.

So funktioniert es

Das Framework bietet einen strukturierten Ansatz zur Agentenverbesserung:

  • Fügen Sie Ihrem Agenten mit 2 Codezeilen Tracing hinzu (oder überspringen Sie zu Schritt 3, wenn Sie bereits Traces haben)
  • Führen Sie Ihren Agenten mehrmals aus, um Ausführungstraces zu sammeln
  • Führen Sie /recursive-improve in Claude Code aus
  • Das System analysiert Traces, findet Fehlermuster, plant Korrekturen und präsentiert sie zur Genehmigung
  • Wenden Sie Korrekturen an, führen Sie den Agenten erneut aus und überprüfen Sie die Verbesserung mit /benchmark gegenüber der Basislinie
  • Wiederholen Sie die Zyklen, um die Verbesserung fortzusetzen

Autonome Option

Für vollständig autonomen Betrieb (ähnlich wie Karpathys Autoresearch):

  • Führen Sie /ratchet aus, um die gesamte Verbesserungsschleife automatisch auszuführen
  • Das System verbessert, bewertet und behält oder macht Änderungen rückgängig
  • Nur Verbesserungen überleben
  • Kann über Nacht laufen, um mit einem besseren Agenten aufzuwachen
Ad

Leistungsergebnisse

Getestet an einem realen Enterprise-Agenten-Benchmark (tau2) mit vollautomatischem Skill-Betrieb:

  • 25 % Leistungssteigerung nach einem einzigen Verbesserungszyklus

Technischer Hintergrund

Die ursprüngliche Forschung umfasste den Aufbau einer rekursiven Sprachmodellarchitektur mit sandboxed REPL für Trace-Analyse im großen Maßstab, Multi-Agenten-Pipelines und anderen Komponenten. Der Entwickler stellte fest, dass die meisten Leute, die Agenten bauen, diese Komplexität nicht benötigen und dass Claude Code ausreichende Fähigkeiten für rekursive Selbstverbesserung bietet.

Das Framework sagt Ihrem Coding-Agenten: Hier sind die Traces, hier ist, wie man sie analysiert, hier ist, wie man Korrekturen priorisiert, und hier ist, wie man sie verifiziert.

Open-Source-Repository: https://github.com/kayba-ai/recursive-improve

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

Offline-Sprache-zu-Text-Tool für macOS mit lokalem Whisper über MLX
Werkzeuge

Offline-Sprache-zu-Text-Tool für macOS mit lokalem Whisper über MLX

Ein Entwickler hat whisper-dictate als Open-Source veröffentlicht, ein macOS-Tool, das vollständig offline Spracherkennung in Text mit Echtzeit-Übersetzungsfunktionen bietet, indem es Whisper lokal über MLX auf Apple Silicon ausführt. Die Transkription dauert etwa 500 ms, nachdem das Sprechen beendet wurde.

OpenClawRadar
Open-Source SwiftUI-Testfunktion für Claude Code nutzt Computer Use zur visuellen App-Testung
Werkzeuge

Open-Source SwiftUI-Testfunktion für Claude Code nutzt Computer Use zur visuellen App-Testung

Eine Open-Source-Fähigkeit für Claude Code namens /ios-test testet SwiftUI-Apps visuell mithilfe der Computer-Use-Fähigkeit. Der Agent findet .xcodeproj-Dateien, baut die App in einem Simulator und navigiert dann durch jeden Bildschirm, tippt auf Buttons und folgt Links wie ein echter Benutzer.

OpenClawRadar
Sandbox0: Open-Source Kubernetes-Native Sandbox-Infrastruktur für KI-Agenten
Werkzeuge

Sandbox0: Open-Source Kubernetes-Native Sandbox-Infrastruktur für KI-Agenten

Sandbox0 ist eine Open-Source-Sandbox-Infrastruktur für KI-Agenten, die auf Kubernetes mit persistenter Speicherung über JuiceFS und automatischer Skalierung aufgebaut ist. Sie behebt Einschränkungen wie Parallelitätsgrenzen und flüchtige Ausführung, die in bestehenden Lösungen zu finden sind.

OpenClawRadar
Merlin: Lokaler LLM-Kontext-Dedup – misst bis zu 71% Chunk-Überlappung, kostenlos & Open-Core
Werkzeuge

Merlin: Lokaler LLM-Kontext-Dedup – misst bis zu 71% Chunk-Überlappung, kostenlos & Open-Core

Merlin ist ein lokales Deduplizierungswerkzeug für LLM-Kontextfenster, das bei 22 Millionen Passagen aus echten Agenten- und RAG-Sitzungen eine Überlappung von 22-71% gemessen hat. Es wird als HTTP-Proxy (Ollama/vLLM/SGLang/llama.cpp), MCP-Server (Claude/Cursor/OpenClaw) oder eigenständiges CLI ausgeliefert. MIT-Open-Core mit täglichen Nutzungsbeschränkungen.

OpenClawRadar