OpenEvol: Offline-Selbstverbesserungspipeline für LLMs unter Verwendung von Konversationsverlauf

Was OpenEvol macht
OpenEvol ist eine Offline-Selbstverbesserungspipeline für große Sprachmodelle, die KI-Konversationsverläufe automatisch in Trainingsdaten umwandelt. Das Tool extrahiert hochwertige Austausche aus Konversationen, bewertet deren Qualität und erstellt Feinabstimmungsdatensätze ohne manuelle Kennzeichnung oder proprietäre Daten-Flywheels.
Wie es funktioniert
Die Pipeline durchläuft vier automatisierte Stufen:
- Hochwertige Austausche aus Konversationen extrahieren
- Qualität mithilfe von Regeln mit optionalem Lehrer-LLM bewerten
- SFT-, Präferenz- und Vortrainingsdatensätze synthetisieren
- Mit einem Befehl feinabstimmen
Dies schafft einen geschlossenen Kreislauf, in dem das Modell aus seinen eigenen Erfahrungen lernt.
Technische Details
Zum Starten wird keine GPU benötigt – die gesamte Pipeline läuft auf CPU mit einem Mock- oder OpenAI-kompatiblen Lehrer-Backend. Eine GPU kann hinzugefügt werden, wenn das Training beginnen soll.
Fünf Lehrer-Backends werden unterstützt:
- Mock
- Regelbasiert
- OpenAI-kompatible API (jeder lokale Proxy funktioniert)
- HuggingFace Transformers
- vLLM
Nutzungsoptionen
Drei Möglichkeiten, OpenEvol zu verwenden:
- CLI für Offline-Stapelverarbeitung
- REST-API-Server für Automatisierung
- OpenClaw-Desktop-Plugin, das Pipeline-Ausführungen direkt aus dem Chat auslöst
Qualitätskontrolle
Jeder Batch wird automatisch bewertet. Wenn die Genehmigungsrate unter 80% fällt, wird das Training blockiert und zur manuellen Überprüfung markiert, sodass Benutzer die Kontrolle darüber haben, welche Daten für das Training verwendet werden.
Dieses Tool ist nützlich für Entwickler, die ihre KI-Coding-Agenten mithilfe tatsächlicher Konversationsverläufe verbessern möchten, ohne Daten an externe Dienste zu senden.
📖 Read the full source: r/openclaw
👀 Siehe auch

OpenClaw Claude-Erweiterung nach Änderungen bei der Anthropic-Abrechnung auf Agent SDK aktualisiert
Ein OpenClaw-Erweiterungsentwickler hat seine Claude-CLI-Integration neu geschrieben, um das offizielle claude-agent-sdk zu verwenden, nachdem Anthropic begonnen hatte, die CLI-Nutzung zu erkennen und als Nutzung durch Drittanbieter-Applikationen neu zu klassifizieren, was gegen einen separaten Guthabenpool anstatt gegen die Max-Plan-Limits abgerechnet wird. Der SDK-Ansatz authentifiziert sich über die bestehende Claude-Code-Anmeldung und rechnet als reguläre Max-Plan-Nutzung ab.

Claude to PDF Chrome-Erweiterung exportiert lange Gespräche mit erhaltener Formatierung
Ein Entwickler hat eine kostenlose Chrome-Erweiterung namens Claude to PDF veröffentlicht, die den gesamten Konversationsverlauf aus Claude AI-Chats erfasst und Codeblöcke, LaTeX-Mathematik und Tabellenformatierung beim Export in PDF beibehält.

Pilot Shell: Eine strukturierte Workflow-Schicht für Claude Code
Pilot Shell fügt spezifikationsgesteuerte TDD-Workflows, Qualitäts-Hooks, Context Engineering und Token-Optimierung auf Basis von Claude Code hinzu – ohne die Komplexität von Multi-Agenten-Frameworks.

PixelCheck: Ein npm-Paket, das KI-Agenten die visuelle Überprüfung von Webseiten ermöglicht
PixelCheck ist ein npm-Paket, das KI-Agenten ermöglicht, Webseiten visuell zu öffnen, zu interagieren und zu bewerten – keine manuellen Screenshot-Feedback-Schleifen mehr.