Rekursiver Selbstverbesserungsrahmen für KI-Codierungsagenten mit Claude Code

Ein Entwickler hat ein Framework open-source gestellt, das KI-Coding-Agenten ermöglicht, sich selbst rekursiv mit Claude Code zu verbessern. Das System wurde nach monatelanger Forschung darüber entwickelt, wie Modellanbieter rekursive Agentenoptimierung implementieren.
So funktioniert es
Das Framework bietet einen strukturierten Ansatz zur Agentenverbesserung:
- Fügen Sie Ihrem Agenten mit 2 Codezeilen Tracing hinzu (oder überspringen Sie zu Schritt 3, wenn Sie bereits Traces haben)
- Führen Sie Ihren Agenten mehrmals aus, um Ausführungstraces zu sammeln
- Führen Sie
/recursive-improvein Claude Code aus - Das System analysiert Traces, findet Fehlermuster, plant Korrekturen und präsentiert sie zur Genehmigung
- Wenden Sie Korrekturen an, führen Sie den Agenten erneut aus und überprüfen Sie die Verbesserung mit
/benchmarkgegenüber der Basislinie - Wiederholen Sie die Zyklen, um die Verbesserung fortzusetzen
Autonome Option
Für vollständig autonomen Betrieb (ähnlich wie Karpathys Autoresearch):
- Führen Sie
/ratchetaus, um die gesamte Verbesserungsschleife automatisch auszuführen - Das System verbessert, bewertet und behält oder macht Änderungen rückgängig
- Nur Verbesserungen überleben
- Kann über Nacht laufen, um mit einem besseren Agenten aufzuwachen
Leistungsergebnisse
Getestet an einem realen Enterprise-Agenten-Benchmark (tau2) mit vollautomatischem Skill-Betrieb:
- 25 % Leistungssteigerung nach einem einzigen Verbesserungszyklus
Technischer Hintergrund
Die ursprüngliche Forschung umfasste den Aufbau einer rekursiven Sprachmodellarchitektur mit sandboxed REPL für Trace-Analyse im großen Maßstab, Multi-Agenten-Pipelines und anderen Komponenten. Der Entwickler stellte fest, dass die meisten Leute, die Agenten bauen, diese Komplexität nicht benötigen und dass Claude Code ausreichende Fähigkeiten für rekursive Selbstverbesserung bietet.
Das Framework sagt Ihrem Coding-Agenten: Hier sind die Traces, hier ist, wie man sie analysiert, hier ist, wie man Korrekturen priorisiert, und hier ist, wie man sie verifiziert.
Open-Source-Repository: https://github.com/kayba-ai/recursive-improve
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Nakkas MCP-Server erzeugt animierte SVGs aus KI-Beschreibungen
Nakkas ist ein MCP-Server, bei dem KI vollständige animierte SVG-Konfigurationen aus Beschreibungen erstellt und saubere animierte SVGs mit Formen, Verläufen, Animationen und Filtern rendert. Es unterstützt parametrische Kurven, 15 Filtervoreinstellungen, CSS @keyframes- und SMIL-Animationen und funktioniert überall, wo SVG gerendert wird.

Sandra: Open-Source persistenter Graph-Speicher MCP für Claude
Sandra ist ein Graph- + Vektor-Speicher-Backend mit einem nativen MCP-Server, der Claude über Sitzungen hinweg persistenten strukturierten Speicher bietet und exakte, unscharfe sowie semantische Suche unterstützt.
GitHubs Projekt HydraFusion: Multi-Modell-Orchestrierung für KI-Codierung auf Spitzenniveau
GitHub Copilots HydraFusion-Forschungsvorschau orchestriert mehrere Modelle pro Aufgabe und wählt zwischen Einzel-, Kaskaden- oder Kritik-Workflows. Benchmarks zeigen eine Qualitätssteigerung von 4,9 Punkten bei 67% geringeren Kosten im Vergleich zu Claude Opus 5.

agentmemory V4 erreicht 96,2 % auf dem LongMemEval-Benchmark und übertrifft damit kommerzielle KI-Gedächtnissysteme.
agentmemory V4 erreichte 96,2 % auf LongMemEval und übertraf damit mehrere geförderte KI-Speicherunternehmen, darunter PwC Chronos (95,6 %), Mastra (94,87 %) und OMEGA (93,2 %). Das System wurde allein in 16 Tagen auf einem Mittelklasse-Gaming-PC mit einem Budget von 1.000 US-Dollar entwickelt.