NVIDIA SkillEvaluator chega ao ClawHub: Uma habilidade é realmente melhor?
ClawHub está adicionando o NVIDIA SkillEvaluator para que você possa ver se uma habilidade realmente ajuda antes de instalá-la. Patrick Erichsen, o engenheiro do OpenClaw por trás do ClawHub, tem trabalhado com a NVIDIA para trazer prova quantitativa à descoberta de habilidades — sem mais julgar pela popularidade ou intuição.
O que há de novo
- Pipeline de avaliação de habilidades — a NVIDIA valida a habilidade, verifica duplicação com capacidades existentes e, em seguida, executa avaliações ao vivo para medir o ganho que ela produz.
- Visualização de avaliação — o ClawHub exibe os mesmos casos de teste com e sem a habilidade, mostrando modelo, avaliador, tentativas, fonte, linha de base e ganho medido — não apenas um selo ou contagem de downloads.
- Resultados verificados — em mais de 300 habilidades verificadas, a NVIDIA relata ganhos médios de 41 pontos em precisão, 39 em eficácia e 35 em eficiência quando a habilidade foi usada.
Como funciona
O pipeline de avaliação executa comparações diretas: para cada habilidade, os mesmos casos de referência são executados com e sem ela. O ganho é calculado a partir da diferença, e esses dados são o que aparece na visualização de avaliação do ClawHub.
Isso importa para dois grupos:
- Usuários — você pode ver se uma habilidade melhora seu Claw antes de instalá-la, não depois.
- Autores de habilidades — você pode provar que o que construiu realmente funciona, com números que os desenvolvedores confiam.
O objetivo de Erichsen é tornar essa evidência parte da experiência padrão de descoberta de habilidades no ClawHub.
📖 Leia a fonte completa: r/openclaw
👀 See Also

cc-session-utils: Painel TUI para Gerenciar Sessões e Custos do Claude Code
Um desenvolvedor criou o cc-session-utils, uma ferramenta de interface de usuário no terminal para gerenciar arquivos de sessão do Claude Code, rastrear custos por modelo, limpar sessões órfãs e migrar dados entre projetos. Requer Python 3.11+ e foi construído com Textual.

Claude 4.6 Opus Raciocínio Destilado para 14GB para Apple Silicon via Quantização MLX
Um desenvolvedor quantizou um modelo Qwen 3.5 27B destilado a partir de trajetórias de raciocínio do Claude 4.6 Opus, reduzindo-o de 55,6GB para 14GB usando MLX para Apple Silicon, alcançando ~16 tokens/seg em um M4 Pro enquanto mantém as capacidades de raciocínio analítico do modelo.
Colaborar: Uma Habilidade de Claude Code para Redação Estruturada e Assíncrona de Documentos com Transferências Multiagente
Uma habilidade do Claude Code chamada 'collaborate' permite a escrita colaborativa de documentos com múltiplos contribuidores, onde cada participante recebe um resumo em linguagem simples do Claude sobre as alterações anteriores, raciocínios e próximas tarefas, com suporte para seções paralelas, crítica estruturada e notificações via Slack/Signal.

Técnica de Double-Buffering para Janelas de Contexto de LLM Elimina a Compactação "Stop-the-World"
Uma técnica chamada de double-buffering pode impedir que agentes de LLM congelem durante a compactação da janela de contexto, resumindo antecipadamente e mantendo dois buffers, permitindo uma transição perfeita sem custo adicional de inferência.