NVIDIA SkillEvaluator arrive sur ClawHub : une compétence est-elle vraiment meilleure ?
ClawHub ajoute NVIDIA SkillEvaluator pour que vous puissiez voir si une compétence aide réellement avant de l'installer. Patrick Erichsen, l'ingénieur OpenClaw derrière ClawHub, a travaillé avec NVIDIA pour apporter une preuve quantitative à la découverte de compétences — fini le jugement basé sur la popularité ou les impressions.
Ce qui est nouveau
- Pipeline d'évaluation des compétences — NVIDIA valide la compétence, vérifie les doublons avec les capacités existantes, puis exécute des évaluations en direct pour mesurer le gain produit.
- Vue d'évaluation — ClawHub affiche les mêmes cas de test avec et sans la compétence, montrant le modèle, le juge, les tentatives, la source, la ligne de base et le gain mesuré — pas seulement un badge ou un compteur de téléchargements.
- Résultats vérifiés — Sur plus de 300 compétences vérifiées, NVIDIA rapporte des gains moyens de 41 points en exactitude, 39 en efficacité et 35 en performance lorsque la compétence est utilisée.
Comment ça marche
Le pipeline d'évaluation exécute des comparaisons en tête-à-tête : pour chaque compétence, les mêmes cas de référence sont exécutés avec et sans elle. Le gain est calculé à partir de la différence, et ces données apparaissent dans la vue d'évaluation de ClawHub.
Cela importe pour deux groupes :
- Utilisateurs — vous pouvez voir si une compétence améliore votre Claw avant de l'installer, pas après.
- Auteurs de compétences — vous pouvez prouver que ce que vous avez construit fonctionne réellement, avec des chiffres que les développeurs apprécient.
L'objectif d'Erichsen est de faire de cette preuve une partie intégrante de l'expérience de découverte de compétences par défaut sur ClawHub.
📖 Lire la source complète : r/openclaw
👀 See Also
Cue AI utilise Gemma 4 pour une dictée vocale plus rapide : baisse de 44 % de la latence, augmentation de 30 % de l'utilisation
Cue AI a remplacé une étape de polissage de texte basée sur le cloud par Gemma 4 E4B de Google DeepMind, exécuté localement via Ollama, réduisant la latence médiane de 876 ms à 488 ms et augmentant l'utilisation de la dictée de 30 %.

Le plugin Claude Code analyse n'importe quel plugin et génère des rapports wiki interactifs.
Un nouveau plugin Claude Code appelé vision-powers analyse n'importe quel chemin de plugin ou URL GitHub et génère un rapport wiki HTML interactif avec des diagrammes d'architecture, des audits de sécurité et des analyses de compétences. L'installation se fait via claude plugin add vision-powers@claude-code-zero.

agentmemory V4 atteint 96,2 % au benchmark LongMemEval, surpassant les systèmes de mémoire d'IA commerciaux.
agentmemory V4 a obtenu un score de 96,2 % sur LongMemEval, surpassant plusieurs entreprises d'IA à mémoire financées, notamment PwC Chronos (95,6 %), Mastra (94,87 %) et OMEGA (93,2 %). Le système a été développé seul en 16 jours sur un PC gaming milieu de gamme avec un budget de 1 000 $.

L'outil Monitor de Claude Code achemine les logs du serveur de développement vers des corrections automatiques pilotées par l'IA
L'outil Monitor de Claude Code vous permet d'exécuter un serveur de développement en arrière-plan, de consulter les logs avec des filtres grep intelligents, et de laisser Claude détecter automatiquement les erreurs, écrire des correctifs et les valider — pendant que vous testez l'interface utilisateur.