NVIDIA SkillEvaluator kommt zu ClawHub: Ist eine Fähigkeit wirklich besser?

✍️ OpenClawRadar📅 Veröffentlicht: 20. August 2026🔗 Source
Ad

ClawHub integriert NVIDIA SkillEvaluator, damit du sehen kannst, ob ein Skill tatsächlich hilft, bevor du ihn installierst. Patrick Erichsen, der OpenClaw-Entwickler hinter ClawHub, hat mit NVIDIA zusammengearbeitet, um quantitative Beweise in die Skill-Entdeckung zu bringen – keine Bewertung mehr nach Beliebtheit oder Bauchgefühl.

Was ist neu

  • Skill-Bewertungspipeline – NVIDIA validiert den Skill, prüft auf Überschneidungen mit bestehenden Funktionen und führt dann Live-Bewertungen durch, um den erzielten Lift zu messen.
  • Eval-Ansicht – ClawHub zeigt dieselben Testfälle mit und ohne Skill, einschließlich Modell, Bewerter, Versuche, Quelle, Baseline und gemessenem Lift – nicht nur ein Abzeichen oder eine Download-Zahl.
  • Verifizierte Ergebnisse – Bei über 300 verifizierten Skills meldet NVIDIA durchschnittliche Gewinne von 41 Punkten bei Korrektheit, 39 bei Effektivität und 35 bei Effizienz, wenn der Skill verwendet wurde.
Ad

So funktioniert es

Die Bewertungspipeline führt direkte Vergleiche durch: Für jeden Skill werden dieselben Benchmark-Fälle mit und ohne Skill ausgeführt. Der Lift wird aus der Differenz berechnet, und diese Daten erscheinen in der ClawHub-Eval-Ansicht.

Das ist für zwei Gruppen wichtig:

  • Benutzer – du kannst sehen, ob ein Skill deinen Claw verbessert, bevor du ihn installierst, nicht erst danach.
  • Skill-Autoren – du kannst beweisen, dass das, was du gebaut hast, tatsächlich funktioniert, mit Zahlen, denen Entwickler vertrauen.

Erichsens Ziel ist es, diese Evidenz zum Standard bei der Skill-Entdeckung auf ClawHub zu machen.

📖 Vollständige Quelle lesen: r/openclaw

Ad

👀 Siehe auch

SuperContext: Ein Persistent Memory Framework für KI-Codierungsagenten
Werkzeuge

SuperContext: Ein Persistent Memory Framework für KI-Codierungsagenten

SuperContext ist ein Open-Source-Framework, das KI-Codierungswerkzeugen wie Claude durch strukturierte, zielgerichtete Dateien anstelle großer Anleitungsdokumente dauerhafte Erinnerung verleiht. Es enthält einen ausführbaren Prompt, der das System in etwa 10 Minuten ohne manuelle Einrichtung aufbaut.

OpenClawRadar
MLJAR Studio: Lokaler KI-Datenanalyst, der reproduzierbare Notebooks erstellt
Werkzeuge

MLJAR Studio: Lokaler KI-Datenanalyst, der reproduzierbare Notebooks erstellt

MLJAR Studio ist eine Desktop-App, die Fragen in natürlicher Sprache in lokal ausgeführte Python-Notebooks umwandelt, mit AutoML für tabellarische Daten und Unterstützung für lokale LLMs über Ollama.

OpenClawRadar
Mengram fügt OpenClaw-Agenten persistenten Speicher hinzu.
Werkzeuge

Mengram fügt OpenClaw-Agenten persistenten Speicher hinzu.

Mengram ist ein Open-Source-Speichersystem, das OpenClaw-Agenten ein Langzeitgedächtnis über Sitzungen hinweg ermöglicht und das Problem löst, dass Agenten bei einem Neustart alles vergessen. Es bietet episodisches, Entitäts- und prozedurales Gedächtnis mit intelligenter Archivierung veralteter Fakten.

OpenClawRadar
ClawControl iOS-Client für selbst gehostete OpenClaw-Server veröffentlicht
Werkzeuge

ClawControl iOS-Client für selbst gehostete OpenClaw-Server veröffentlicht

ClawControl v1.50 ist jetzt auf iOS verfügbar als datenschutzorientierter mobiler Client für selbst gehostete OpenClaw/Claw-Server. Die Open-Source-App ermöglicht Echtzeit-Chat mit Streaming-Antworten, Agentenverwaltung und Sitzungskontrolle von mobilen Geräten aus.

OpenClawRadar