OpenEvol: Offline-Selbstverbesserungspipeline für LLMs unter Verwendung von Konversationsverlauf

✍️ OpenClawRadar📅 Veröffentlicht: 31. März 2026🔗 Source
OpenEvol: Offline-Selbstverbesserungspipeline für LLMs unter Verwendung von Konversationsverlauf
Ad

Was OpenEvol macht

OpenEvol ist eine Offline-Selbstverbesserungspipeline für große Sprachmodelle, die KI-Konversationsverläufe automatisch in Trainingsdaten umwandelt. Das Tool extrahiert hochwertige Austausche aus Konversationen, bewertet deren Qualität und erstellt Feinabstimmungsdatensätze ohne manuelle Kennzeichnung oder proprietäre Daten-Flywheels.

Wie es funktioniert

Die Pipeline durchläuft vier automatisierte Stufen:

  • Hochwertige Austausche aus Konversationen extrahieren
  • Qualität mithilfe von Regeln mit optionalem Lehrer-LLM bewerten
  • SFT-, Präferenz- und Vortrainingsdatensätze synthetisieren
  • Mit einem Befehl feinabstimmen

Dies schafft einen geschlossenen Kreislauf, in dem das Modell aus seinen eigenen Erfahrungen lernt.

Technische Details

Zum Starten wird keine GPU benötigt – die gesamte Pipeline läuft auf CPU mit einem Mock- oder OpenAI-kompatiblen Lehrer-Backend. Eine GPU kann hinzugefügt werden, wenn das Training beginnen soll.

Fünf Lehrer-Backends werden unterstützt:

  • Mock
  • Regelbasiert
  • OpenAI-kompatible API (jeder lokale Proxy funktioniert)
  • HuggingFace Transformers
  • vLLM
Ad

Nutzungsoptionen

Drei Möglichkeiten, OpenEvol zu verwenden:

  • CLI für Offline-Stapelverarbeitung
  • REST-API-Server für Automatisierung
  • OpenClaw-Desktop-Plugin, das Pipeline-Ausführungen direkt aus dem Chat auslöst

Qualitätskontrolle

Jeder Batch wird automatisch bewertet. Wenn die Genehmigungsrate unter 80% fällt, wird das Training blockiert und zur manuellen Überprüfung markiert, sodass Benutzer die Kontrolle darüber haben, welche Daten für das Training verwendet werden.

Dieses Tool ist nützlich für Entwickler, die ihre KI-Coding-Agenten mithilfe tatsächlicher Konversationsverläufe verbessern möchten, ohne Daten an externe Dienste zu senden.

📖 Read the full source: r/openclaw

Ad

👀 Siehe auch

OpenClaw Claude-Erweiterung nach Änderungen bei der Anthropic-Abrechnung auf Agent SDK aktualisiert
Werkzeuge

OpenClaw Claude-Erweiterung nach Änderungen bei der Anthropic-Abrechnung auf Agent SDK aktualisiert

Ein OpenClaw-Erweiterungsentwickler hat seine Claude-CLI-Integration neu geschrieben, um das offizielle claude-agent-sdk zu verwenden, nachdem Anthropic begonnen hatte, die CLI-Nutzung zu erkennen und als Nutzung durch Drittanbieter-Applikationen neu zu klassifizieren, was gegen einen separaten Guthabenpool anstatt gegen die Max-Plan-Limits abgerechnet wird. Der SDK-Ansatz authentifiziert sich über die bestehende Claude-Code-Anmeldung und rechnet als reguläre Max-Plan-Nutzung ab.

OpenClawRadar
Claude to PDF Chrome-Erweiterung exportiert lange Gespräche mit erhaltener Formatierung
Werkzeuge

Claude to PDF Chrome-Erweiterung exportiert lange Gespräche mit erhaltener Formatierung

Ein Entwickler hat eine kostenlose Chrome-Erweiterung namens Claude to PDF veröffentlicht, die den gesamten Konversationsverlauf aus Claude AI-Chats erfasst und Codeblöcke, LaTeX-Mathematik und Tabellenformatierung beim Export in PDF beibehält.

OpenClawRadar
Pilot Shell: Eine strukturierte Workflow-Schicht für Claude Code
Werkzeuge

Pilot Shell: Eine strukturierte Workflow-Schicht für Claude Code

Pilot Shell fügt spezifikationsgesteuerte TDD-Workflows, Qualitäts-Hooks, Context Engineering und Token-Optimierung auf Basis von Claude Code hinzu – ohne die Komplexität von Multi-Agenten-Frameworks.

OpenClawRadar
PixelCheck: Ein npm-Paket, das KI-Agenten die visuelle Überprüfung von Webseiten ermöglicht
Werkzeuge

PixelCheck: Ein npm-Paket, das KI-Agenten die visuelle Überprüfung von Webseiten ermöglicht

PixelCheck ist ein npm-Paket, das KI-Agenten ermöglicht, Webseiten visuell zu öffnen, zu interagieren und zu bewerten – keine manuellen Screenshot-Feedback-Schleifen mehr.

OpenClawRadar