NVIDIA SkillEvaluator 登陆 ClawHub:技能真的更好吗?
ClawHub добавляет NVIDIA SkillEvaluator, чтобы вы могли видеть, действительно ли навык помогает, прежде чем его устанавливать. Патрик Эриксен, инженер OpenClaw, стоящий за ClawHub, работал с NVIDIA, чтобы предоставить количественные доказательства при поиске навыков — больше никакой оценки по популярности или наитию.
Что нового
- Конвейер оценки навыков — NVIDIA проверяет навык, проверяет дублирование с существующими возможностями, затем запускает живые оценки для измерения прироста, который он дает.
- Просмотр оценки — ClawHub отображает те же тестовые примеры с навыком и без него, показывая модель, судью, попытки, источник, базовый уровень и измеренный прирост — не просто значок или количество загрузок.
- Проверенные результаты — Среди более чем 300 проверенных навыков NVIDIA сообщает о среднем приросте в 41 балл по корректности, 39 по эффективности и 35 по производительности при использовании навыка.
Как это работает
Конвейер оценки запускает попарные сравнения: для каждого навыка одни и те же тестовые примеры выполняются с ним и без него. Прирост рассчитывается из разницы, и эти данные отображаются в представлении оценки ClawHub.
Это важно для двух групп:
- Пользователи — вы можете увидеть, делает ли навык вашего Claw лучше, до установки, а не после.
- Авторы навыков — вы можете доказать, что созданное вами действительно работает, с цифрами, которым доверяют разработчики.
Цель Эриксена — сделать эти доказательства частью стандартного процесса поиска навыков на ClawHub.
📖 Читать полный источник: r/openclaw
👀 Смотрите также

Локально-облачная гибридная архитектура ИИ: практические паттерны, вдохновленные r/LocalLLaMA
В исходном посте предлагается гибридная модель ИИ, где локальная модель обрабатывает рутинные задачи и передает сложные рассуждения облачной модели через один вызов API, а также детерминированный «гипервизор» для ограничений безопасности.

TREX: ИИ-ревьюер кода от Greptile, который запускает ваш код
TREX — это уровень выполнения кода, встроенный в AI-ревью кода от Greptile. Он запускает код и показывает скриншоты, логи и трассы для ошибок, которые упускает статический анализ.

Командный центр: среда ИИ-кодирования для тех, кто заботится о качестве
Command Center — это среда агентного кодирования, ориентированная на сложные аспекты кода, сгенерированного ИИ: ревью, рефакторинг и поставка с традиционной инженерной дисциплиной. Включает обзоры, агенты рефакторинга и восстановление из снимков.

ИИ поглотил уровень перевода: Организационная структура после внедрения агентов
Ажей Гор утверждает, что ИИ не заменил должности — он поглотил задачу перевода. Середина оргструктуры (инженерные менеджеры, scrum-мастера, tech-лиды) сокращается, так как агенты напрямую преобразуют требования в код.