Harmonic-9B: Ajuste fino em duas etapas do Qwen3.5-9B para agentes de IA

✍️ OpenClawRadar📅 Publicado: April 15, 2026🔗 Source
Harmonic-9B: Ajuste fino em duas etapas do Qwen3.5-9B para agentes de IA
Ad

O que é o Harmonic-9B?

Harmonic-9B é uma versão fine-tuned do Qwen3.5-9B especificamente projetada para aplicações de agentes de IA. O desenvolvedor está usando uma abordagem de treinamento em duas etapas: a Etapa 1 foca no treinamento de raciocínio pesado (já concluído), enquanto a Etapa 2 foca na chamada leve de ferramentas e no fine-tuning de agentes (ainda em andamento no momento do anúncio).

Detalhes Técnicos

O objetivo é combinar um raciocínio estruturado forte com um uso de ferramentas limpo e confiável, mantendo capacidades naturais de conversação. Para a Etapa 2, o desenvolvedor filtrou um conjunto de dados de traços de agentes Hermes, que foi disponibilizado como código aberto no Hugging Face.

Principais melhorias no conjunto de dados filtrado:

  • Auto-correção: 6% → 63%
  • Etapas de verificação: 26% → 96%
  • Profundidade de pensamento: +40%
  • Chamadas de ferramentas/JSON válidos: 100%

Versões quantizadas GGUF já estão disponíveis para download, embora o desenvolvedor observe que ainda não executou benchmarks adequados porque a Etapa 2 ainda está em treinamento. Verificações iniciais no checkpoint da Etapa 1 mostraram bons resultados para a estrutura de raciocínio.

Ad

Status Atual e Próximos Passos

O desenvolvedor está buscando feedback sobre como o Harmonic-9B se comporta em estruturas de agentes como OpenClaw, LangGraph e ReAct. Eles planejam compartilhar números de benchmark assim que a Etapa 2 for concluída e puderem executar avaliações adequadas de agentes. Este trabalho faz parte de uma pesquisa contínua sobre curadoria de dados de alto sinal e abordagens de fine-tuning em etapas.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also