NVIDIA SkillEvaluator chega ao ClawHub: Uma habilidade é realmente melhor?

✍️ OpenClawRadar📅 Publicado: August 20, 2026🔗 Source
Ad

ClawHub está adicionando o NVIDIA SkillEvaluator para que você possa ver se uma habilidade realmente ajuda antes de instalá-la. Patrick Erichsen, o engenheiro do OpenClaw por trás do ClawHub, tem trabalhado com a NVIDIA para trazer prova quantitativa à descoberta de habilidades — sem mais julgar pela popularidade ou intuição.

O que há de novo

  • Pipeline de avaliação de habilidades — a NVIDIA valida a habilidade, verifica duplicação com capacidades existentes e, em seguida, executa avaliações ao vivo para medir o ganho que ela produz.
  • Visualização de avaliação — o ClawHub exibe os mesmos casos de teste com e sem a habilidade, mostrando modelo, avaliador, tentativas, fonte, linha de base e ganho medido — não apenas um selo ou contagem de downloads.
  • Resultados verificados — em mais de 300 habilidades verificadas, a NVIDIA relata ganhos médios de 41 pontos em precisão, 39 em eficácia e 35 em eficiência quando a habilidade foi usada.
Ad

Como funciona

O pipeline de avaliação executa comparações diretas: para cada habilidade, os mesmos casos de referência são executados com e sem ela. O ganho é calculado a partir da diferença, e esses dados são o que aparece na visualização de avaliação do ClawHub.

Isso importa para dois grupos:

  • Usuários — você pode ver se uma habilidade melhora seu Claw antes de instalá-la, não depois.
  • Autores de habilidades — você pode provar que o que construiu realmente funciona, com números que os desenvolvedores confiam.

O objetivo de Erichsen é tornar essa evidência parte da experiência padrão de descoberta de habilidades no ClawHub.

📖 Leia a fonte completa: r/openclaw

Ad

👀 See Also

cc-session-utils: Painel TUI para Gerenciar Sessões e Custos do Claude Code
Tools

cc-session-utils: Painel TUI para Gerenciar Sessões e Custos do Claude Code

Um desenvolvedor criou o cc-session-utils, uma ferramenta de interface de usuário no terminal para gerenciar arquivos de sessão do Claude Code, rastrear custos por modelo, limpar sessões órfãs e migrar dados entre projetos. Requer Python 3.11+ e foi construído com Textual.

OpenClawRadar
Claude 4.6 Opus Raciocínio Destilado para 14GB para Apple Silicon via Quantização MLX
Tools

Claude 4.6 Opus Raciocínio Destilado para 14GB para Apple Silicon via Quantização MLX

Um desenvolvedor quantizou um modelo Qwen 3.5 27B destilado a partir de trajetórias de raciocínio do Claude 4.6 Opus, reduzindo-o de 55,6GB para 14GB usando MLX para Apple Silicon, alcançando ~16 tokens/seg em um M4 Pro enquanto mantém as capacidades de raciocínio analítico do modelo.

OpenClawRadar
🦀
Tools

Colaborar: Uma Habilidade de Claude Code para Redação Estruturada e Assíncrona de Documentos com Transferências Multiagente

Uma habilidade do Claude Code chamada 'collaborate' permite a escrita colaborativa de documentos com múltiplos contribuidores, onde cada participante recebe um resumo em linguagem simples do Claude sobre as alterações anteriores, raciocínios e próximas tarefas, com suporte para seções paralelas, crítica estruturada e notificações via Slack/Signal.

OpenClawRadar
Técnica de Double-Buffering para Janelas de Contexto de LLM Elimina a Compactação "Stop-the-World"
Tools

Técnica de Double-Buffering para Janelas de Contexto de LLM Elimina a Compactação "Stop-the-World"

Uma técnica chamada de double-buffering pode impedir que agentes de LLM congelem durante a compactação da janela de contexto, resumindo antecipadamente e mantendo dois buffers, permitindo uma transição perfeita sem custo adicional de inferência.

OpenClawRadar