NVIDIA SkillEvaluator kommt zu ClawHub: Ist eine Fähigkeit wirklich besser?
ClawHub integriert NVIDIA SkillEvaluator, damit du sehen kannst, ob ein Skill tatsächlich hilft, bevor du ihn installierst. Patrick Erichsen, der OpenClaw-Entwickler hinter ClawHub, hat mit NVIDIA zusammengearbeitet, um quantitative Beweise in die Skill-Entdeckung zu bringen – keine Bewertung mehr nach Beliebtheit oder Bauchgefühl.
Was ist neu
- Skill-Bewertungspipeline – NVIDIA validiert den Skill, prüft auf Überschneidungen mit bestehenden Funktionen und führt dann Live-Bewertungen durch, um den erzielten Lift zu messen.
- Eval-Ansicht – ClawHub zeigt dieselben Testfälle mit und ohne Skill, einschließlich Modell, Bewerter, Versuche, Quelle, Baseline und gemessenem Lift – nicht nur ein Abzeichen oder eine Download-Zahl.
- Verifizierte Ergebnisse – Bei über 300 verifizierten Skills meldet NVIDIA durchschnittliche Gewinne von 41 Punkten bei Korrektheit, 39 bei Effektivität und 35 bei Effizienz, wenn der Skill verwendet wurde.
So funktioniert es
Die Bewertungspipeline führt direkte Vergleiche durch: Für jeden Skill werden dieselben Benchmark-Fälle mit und ohne Skill ausgeführt. Der Lift wird aus der Differenz berechnet, und diese Daten erscheinen in der ClawHub-Eval-Ansicht.
Das ist für zwei Gruppen wichtig:
- Benutzer – du kannst sehen, ob ein Skill deinen Claw verbessert, bevor du ihn installierst, nicht erst danach.
- Skill-Autoren – du kannst beweisen, dass das, was du gebaut hast, tatsächlich funktioniert, mit Zahlen, denen Entwickler vertrauen.
Erichsens Ziel ist es, diese Evidenz zum Standard bei der Skill-Entdeckung auf ClawHub zu machen.
📖 Vollständige Quelle lesen: r/openclaw
👀 Siehe auch

SuperContext: Ein Persistent Memory Framework für KI-Codierungsagenten
SuperContext ist ein Open-Source-Framework, das KI-Codierungswerkzeugen wie Claude durch strukturierte, zielgerichtete Dateien anstelle großer Anleitungsdokumente dauerhafte Erinnerung verleiht. Es enthält einen ausführbaren Prompt, der das System in etwa 10 Minuten ohne manuelle Einrichtung aufbaut.

MLJAR Studio: Lokaler KI-Datenanalyst, der reproduzierbare Notebooks erstellt
MLJAR Studio ist eine Desktop-App, die Fragen in natürlicher Sprache in lokal ausgeführte Python-Notebooks umwandelt, mit AutoML für tabellarische Daten und Unterstützung für lokale LLMs über Ollama.

Mengram fügt OpenClaw-Agenten persistenten Speicher hinzu.
Mengram ist ein Open-Source-Speichersystem, das OpenClaw-Agenten ein Langzeitgedächtnis über Sitzungen hinweg ermöglicht und das Problem löst, dass Agenten bei einem Neustart alles vergessen. Es bietet episodisches, Entitäts- und prozedurales Gedächtnis mit intelligenter Archivierung veralteter Fakten.

ClawControl iOS-Client für selbst gehostete OpenClaw-Server veröffentlicht
ClawControl v1.50 ist jetzt auf iOS verfügbar als datenschutzorientierter mobiler Client für selbst gehostete OpenClaw/Claw-Server. Die Open-Source-App ermöglicht Echtzeit-Chat mit Streaming-Antworten, Agentenverwaltung und Sitzungskontrolle von mobilen Geräten aus.