NVIDIA SkillEvaluator 登陆 ClawHub:技能真的更好吗?
ClawHub добавляет NVIDIA SkillEvaluator, чтобы вы могли видеть, действительно ли навык помогает, прежде чем его устанавливать. Патрик Эриксен, инженер OpenClaw, стоящий за ClawHub, работал с NVIDIA, чтобы предоставить количественные доказательства при поиске навыков — больше никакой оценки по популярности или наитию.
Что нового
- Конвейер оценки навыков — NVIDIA проверяет навык, проверяет дублирование с существующими возможностями, затем запускает живые оценки для измерения прироста, который он дает.
- Просмотр оценки — ClawHub отображает те же тестовые примеры с навыком и без него, показывая модель, судью, попытки, источник, базовый уровень и измеренный прирост — не просто значок или количество загрузок.
- Проверенные результаты — Среди более чем 300 проверенных навыков NVIDIA сообщает о среднем приросте в 41 балл по корректности, 39 по эффективности и 35 по производительности при использовании навыка.
Как это работает
Конвейер оценки запускает попарные сравнения: для каждого навыка одни и те же тестовые примеры выполняются с ним и без него. Прирост рассчитывается из разницы, и эти данные отображаются в представлении оценки ClawHub.
Это важно для двух групп:
- Пользователи — вы можете увидеть, делает ли навык вашего Claw лучше, до установки, а не после.
- Авторы навыков — вы можете доказать, что созданное вами действительно работает, с цифрами, которым доверяют разработчики.
Цель Эриксена — сделать эти доказательства частью стандартного процесса поиска навыков на ClawHub.
📖 Читать полный источник: r/openclaw
👀 Смотрите также

Lat.md: Граф знаний на основе Markdown для кодовых баз
Lat.md создает граф знаний для кодовых баз, используя взаимосвязанные markdown-файлы в директории lat.md/. Он решает проблемы масштабирования монолитной документации, связывая разделы с помощью [[вики-ссылок]], подключаясь к исходному коду через комментарии вроде // @lat: [[section-id]] и предоставляя CLI-инструменты для проверки и поиска.

PromptForest: Обнаружение инъекций промптов с приоритетом локальности и учетом неопределенности
PromptForest — это легковесная библиотека с приоритетом локальности, которая обнаруживает инъекции запросов и джейлбрейки, классифицируя их и оценивая степень уверенности, все это без увеличения средней задержки запросов.

Claude Code v2.1.142: Новые флаги агентов Claude, Opus 4.7 по умолчанию и исправления ошибок
Claude Code v2.1.142 добавляет восемь новых флагов для настройки фоновых сессий, переключает быстрый режим на Opus 4.7 по умолчанию и исправляет более десятка ошибок, включая тайм-аут MCP-инструментов, проблемы с демоном при сне/пробуждении macOS и взаимоблокировки на сетевых дисках Windows.

Сравнение Dual DGX Sparks и Mac Studio M3 Ultra: практический тест для локального запуска Qwen3.5 397B
Разработчик сравнил локальный запуск Qwen3.5 397B на Mac Studio M3 Ultra 512GB за $10K и на настройке с двумя DGX Spark за $10K. Mac Studio показал 30-40 токенов/с с пропускной способностью памяти 800 ГБ/с, но медленным предзаполнением, в то время как Sparks выдавали 27-28 токенов/с с более быстрыми вычислениями, но сложной настройкой.