NVIDIA SkillEvaluator 登陆 ClawHub:技能真的更好吗?

✍️ OpenClawRadar📅 Опубликовано: 20 августа 2026 г.🔗 Source
Ad

ClawHub добавляет NVIDIA SkillEvaluator, чтобы вы могли видеть, действительно ли навык помогает, прежде чем его устанавливать. Патрик Эриксен, инженер OpenClaw, стоящий за ClawHub, работал с NVIDIA, чтобы предоставить количественные доказательства при поиске навыков — больше никакой оценки по популярности или наитию.

Что нового

  • Конвейер оценки навыков — NVIDIA проверяет навык, проверяет дублирование с существующими возможностями, затем запускает живые оценки для измерения прироста, который он дает.
  • Просмотр оценки — ClawHub отображает те же тестовые примеры с навыком и без него, показывая модель, судью, попытки, источник, базовый уровень и измеренный прирост — не просто значок или количество загрузок.
  • Проверенные результаты — Среди более чем 300 проверенных навыков NVIDIA сообщает о среднем приросте в 41 балл по корректности, 39 по эффективности и 35 по производительности при использовании навыка.
Ad

Как это работает

Конвейер оценки запускает попарные сравнения: для каждого навыка одни и те же тестовые примеры выполняются с ним и без него. Прирост рассчитывается из разницы, и эти данные отображаются в представлении оценки ClawHub.

Это важно для двух групп:

  • Пользователи — вы можете увидеть, делает ли навык вашего Claw лучше, до установки, а не после.
  • Авторы навыков — вы можете доказать, что созданное вами действительно работает, с цифрами, которым доверяют разработчики.

Цель Эриксена — сделать эти доказательства частью стандартного процесса поиска навыков на ClawHub.

📖 Читать полный источник: r/openclaw

Ad

👀 Смотрите также

Локально-облачная гибридная архитектура ИИ: практические паттерны, вдохновленные r/LocalLLaMA
Инструменты

Локально-облачная гибридная архитектура ИИ: практические паттерны, вдохновленные r/LocalLLaMA

В исходном посте предлагается гибридная модель ИИ, где локальная модель обрабатывает рутинные задачи и передает сложные рассуждения облачной модели через один вызов API, а также детерминированный «гипервизор» для ограничений безопасности.

OpenClawRadar
TREX: ИИ-ревьюер кода от Greptile, который запускает ваш код
Инструменты

TREX: ИИ-ревьюер кода от Greptile, который запускает ваш код

TREX — это уровень выполнения кода, встроенный в AI-ревью кода от Greptile. Он запускает код и показывает скриншоты, логи и трассы для ошибок, которые упускает статический анализ.

OpenClawRadar
Командный центр: среда ИИ-кодирования для тех, кто заботится о качестве
Инструменты

Командный центр: среда ИИ-кодирования для тех, кто заботится о качестве

Command Center — это среда агентного кодирования, ориентированная на сложные аспекты кода, сгенерированного ИИ: ревью, рефакторинг и поставка с традиционной инженерной дисциплиной. Включает обзоры, агенты рефакторинга и восстановление из снимков.

OpenClawRadar
ИИ поглотил уровень перевода: Организационная структура после внедрения агентов
Инструменты

ИИ поглотил уровень перевода: Организационная структура после внедрения агентов

Ажей Гор утверждает, что ИИ не заменил должности — он поглотил задачу перевода. Середина оргструктуры (инженерные менеджеры, scrum-мастера, tech-лиды) сокращается, так как агенты напрямую преобразуют требования в код.

OpenClawRadar