NVIDIA SkillEvaluator kommt zu ClawHub: Ist eine Fähigkeit wirklich besser?

✍️ OpenClawRadar📅 Veröffentlicht: 20. August 2026🔗 Source
Ad

ClawHub integriert NVIDIA SkillEvaluator, damit du sehen kannst, ob ein Skill tatsächlich hilft, bevor du ihn installierst. Patrick Erichsen, der OpenClaw-Entwickler hinter ClawHub, hat mit NVIDIA zusammengearbeitet, um quantitative Beweise in die Skill-Entdeckung zu bringen – keine Bewertung mehr nach Beliebtheit oder Bauchgefühl.

Was ist neu

  • Skill-Bewertungspipeline – NVIDIA validiert den Skill, prüft auf Überschneidungen mit bestehenden Funktionen und führt dann Live-Bewertungen durch, um den erzielten Lift zu messen.
  • Eval-Ansicht – ClawHub zeigt dieselben Testfälle mit und ohne Skill, einschließlich Modell, Bewerter, Versuche, Quelle, Baseline und gemessenem Lift – nicht nur ein Abzeichen oder eine Download-Zahl.
  • Verifizierte Ergebnisse – Bei über 300 verifizierten Skills meldet NVIDIA durchschnittliche Gewinne von 41 Punkten bei Korrektheit, 39 bei Effektivität und 35 bei Effizienz, wenn der Skill verwendet wurde.
Ad

So funktioniert es

Die Bewertungspipeline führt direkte Vergleiche durch: Für jeden Skill werden dieselben Benchmark-Fälle mit und ohne Skill ausgeführt. Der Lift wird aus der Differenz berechnet, und diese Daten erscheinen in der ClawHub-Eval-Ansicht.

Das ist für zwei Gruppen wichtig:

  • Benutzer – du kannst sehen, ob ein Skill deinen Claw verbessert, bevor du ihn installierst, nicht erst danach.
  • Skill-Autoren – du kannst beweisen, dass das, was du gebaut hast, tatsächlich funktioniert, mit Zahlen, denen Entwickler vertrauen.

Erichsens Ziel ist es, diese Evidenz zum Standard bei der Skill-Entdeckung auf ClawHub zu machen.

📖 Vollständige Quelle lesen: r/openclaw

Ad

👀 Siehe auch

Octopoda: Open-Source-Speicherschicht für lokale KI-Agenten
Werkzeuge

Octopoda: Open-Source-Speicherschicht für lokale KI-Agenten

Octopoda ist eine Open-Source-Gedächtnisschicht, die lokalen KI-Agenten persistente Erinnerungen zwischen Sitzungen, semantische Suche, Schleifenerkennung und Absturzwiederherstellung bietet. Es läuft vollständig offline mit einem 33 MB großen Embedding-Modell und integriert sich mit LangChain, CrewAI, AutoGen und dem OpenAI Agents SDK.

OpenClawRadar
6GB GPU上的会议摘要:qwen3.5:0.8B在57秒内完成,Granite 4 350M产生幻觉
Werkzeuge

6GB GPU上的会议摘要:qwen3.5:0.8B在57秒内完成,Granite 4 350M产生幻觉

VoiceFlow v1.6.0 fügt lokale Meeting-Aufzeichnung und Zusammenfassung hinzu. Benchmarking von Sub-1B-Modellen auf einer 6GB RTX 3060: qwen3.5:0.8B erstellt strukturierte Zusammenfassungen in 57s bei 2,2GB VRAM, während Granite 4 350M stark halluziniert.

OpenClawRadar
Terrarium: Open-Source Sandbox für agentische Umgebungen mit Time-Machine-Rückspulfunktion
Werkzeuge

Terrarium: Open-Source Sandbox für agentische Umgebungen mit Time-Machine-Rückspulfunktion

Eine vielseitige Sandbox-Lösung, um mehrere KI-Agenten sicher auf jedem VPS oder in der Cloud auszuführen. Bietet isolierte Welten, Reverse-Proxy-Verwaltung, GUIs und eine Zeitmaschine zum Zurückspulen des Container-Zustands.

OpenClawRadar
Windows-System-Tray-Monitor für Claude-Code-Kontingent
Werkzeuge

Windows-System-Tray-Monitor für Claude-Code-Kontingent

Eine Windows-Systemtray-Anwendung, die die Claude Code-Nutzung mit einem farbcodierten Symbol überwacht, Kontingentdaten alle 5 Minuten über die Anthropic OAuth API automatisch aktualisiert und detaillierte Dashboards mit stündlichen, täglichen, wöchentlichen und monatlichen Nutzungsmustern bereitstellt.

OpenClawRadar