Aproveitando as Habilidades do Agente para Escrever Kernels CUDA com Upskill

A Hugging Face introduziu um método para melhorar o desempenho de modelos menores de IA em tarefas complexas, como escrever kernels CUDA, através do uso de habilidades de agentes. Este processo utiliza a nova ferramenta upskill, permitindo que você gere e avalie habilidades de agentes com modelos grandes e aplique essas habilidades a modelos menores ou mais econômicos.
Habilidades de agentes são formas empacotadas de conhecimento que podem ser trocadas entre modelos e ferramentas, definidas como arquivos contendo instruções em markdown e scripts. Elas se mostram particularmente benéficas em domínios de problemas de nicho ou difíceis onde os modelos podem não se destacar naturalmente.
Passos para Aprimorar Usando Claude e a Ferramenta Upskill
1. Construindo um Kernel com Claude Opus 4.5: O processo começa empregando o Claude Code para montar interativamente um kernel e exportar o rastreamento. Isso envolve iterar soluções com habilidades de rascunho, permitindo melhoria contínua através da experimentação com modelos menores.
2. Criando uma Habilidade de Agente a Partir do Rastreamento: Após a construção do kernel, instrua o Claude a gerar um arquivo de habilidade para a tarefa concluída. Empregar o 'criador de habilidades' da Anthropic também pode facilitar esse processo, criando habilidades com base no rastreamento da atividade do agente. O upskill aumenta a utilidade fornecendo também casos de teste para avaliar o desempenho da habilidade.
3. Aplicando a Habilidade em Diferentes Modelos: Transfira a habilidade recém-criada para os modelos desejados seguindo práticas padrão, onde as habilidades são formatadas como diretórios, por exemplo, {agent}/skills/{skill_name}/SKILL.md. Use comandos upskill eval para executar comparações de desempenho do modelo usando essas habilidades, destacando diferenças em precisão e uso de tokens em várias plataformas como codex ou cursor.
Por fim, as habilidades podem ajudar a reduzir o consumo de tokens enquanto mantêm a precisão, crucial para tarefas recorrentes em diferentes modelos. No entanto, variações na eficácia sugerem que o refinamento iterativo das habilidades pode ser necessário.
📖 Leia a fonte completa: Hugging Face Blog
👀 See Also

Como um Agente Inativo Queimava 50M Tokens por Dia – e Como Corrigir Isso
Um agente OpenClaw ocioso queimava 50 milhões de tokens por dia com pings de heartbeat em uma sessão inchada. Um usuário do Reddit conta como rastreou o vazamento e o corrigiu com alterações na configuração.

Estruturando Agentes de Código Claude com Padrões de Diretório .claude/ e CLAUDE.md
Um desenvolvedor compartilha sua abordagem para executar múltiplos agentes de IA usando o Claude Code, com cada agente tendo seu próprio diretório contendo um arquivo CLAUDE.md e um diretório .claude/ com regras e habilidades. A ideia principal é separar o contexto sempre ativo dos fluxos de trabalho sob demanda para otimizar o uso de tokens e a qualidade das respostas.

AGENTS.md Feito Corretamente: Um Aumento de 25% na Precisão — ou uma Queda de 30%
A Augment Code testou arquivos AGENTS.md frente a frente: os melhores rivalizam com uma atualização de modelo de Haiku para Opus; os piores prejudicam a saída. Tabelas de decisão, fluxos de trabalho procedurais e divulgação progressiva vencem.

Desenvolvedor de iOS Compartilha Melhores Práticas de Código Claude Após Lançar Múltiplos Aplicativos
Um desenvolvedor iOS com experiência em cibersegurança descreve práticas específicas para usar o Claude Code de forma eficaz, incluindo separação de ambientes, configuração de observabilidade e evitar o acúmulo de dívida técnica.