Harmonic-9B: Ajuste fino em duas etapas do Qwen3.5-9B para agentes de IA

✍️ OpenClawRadar📅 Publicado: April 15, 2026🔗 Source
Harmonic-9B: Ajuste fino em duas etapas do Qwen3.5-9B para agentes de IA
Ad

O que é o Harmonic-9B?

Harmonic-9B é uma versão fine-tuned do Qwen3.5-9B especificamente projetada para aplicações de agentes de IA. O desenvolvedor está usando uma abordagem de treinamento em duas etapas: a Etapa 1 foca no treinamento de raciocínio pesado (já concluído), enquanto a Etapa 2 foca na chamada leve de ferramentas e no fine-tuning de agentes (ainda em andamento no momento do anúncio).

Detalhes Técnicos

O objetivo é combinar um raciocínio estruturado forte com um uso de ferramentas limpo e confiável, mantendo capacidades naturais de conversação. Para a Etapa 2, o desenvolvedor filtrou um conjunto de dados de traços de agentes Hermes, que foi disponibilizado como código aberto no Hugging Face.

Principais melhorias no conjunto de dados filtrado:

  • Auto-correção: 6% → 63%
  • Etapas de verificação: 26% → 96%
  • Profundidade de pensamento: +40%
  • Chamadas de ferramentas/JSON válidos: 100%

Versões quantizadas GGUF já estão disponíveis para download, embora o desenvolvedor observe que ainda não executou benchmarks adequados porque a Etapa 2 ainda está em treinamento. Verificações iniciais no checkpoint da Etapa 1 mostraram bons resultados para a estrutura de raciocínio.

Ad

Status Atual e Próximos Passos

O desenvolvedor está buscando feedback sobre como o Harmonic-9B se comporta em estruturas de agentes como OpenClaw, LangGraph e ReAct. Eles planejam compartilhar números de benchmark assim que a Etapa 2 for concluída e puderem executar avaliações adequadas de agentes. Este trabalho faz parte de uma pesquisa contínua sobre curadoria de dados de alto sinal e abordagens de fine-tuning em etapas.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Protocolo de Convergência Quumble v5: Resultados de Experimentos com LLM de Arquitetura Cruzada
News

Protocolo de Convergência Quumble v5: Resultados de Experimentos com LLM de Arquitetura Cruzada

O Protocolo de Convergência Quumble v5 testa se instâncias independentes de LLM convergem para descrições de criaturas imaginárias ao receberem palavras sem sentido. Os resultados mostram que tanto Claude (Opus 4.6 e Sonnet 4.6) quanto GPT-5.3 produziram independentemente uma criatura pequena, redonda, macia, com tonalidade lavanda, bioluminescente e que emite um zumbido a partir da palavra 'quumble'.

OpenClawRadar
Centros de Dados de IA Aumentam Temperaturas Locais Até 9,1°C, Revela Estudo
News

Centros de Dados de IA Aumentam Temperaturas Locais Até 9,1°C, Revela Estudo

Um estudo da Universidade de Cambridge descobriu que os data centers de IA elevam a temperatura da superfície terrestre em média 2°C após o início das operações, com casos extremos atingindo aumentos de 9,1°C, afetando áreas de até 10 quilômetros de distância.

OpenClawRadar
MCP é Apenas Bibliotecas Reempacotadas: Déjà Vu Novamente
News

MCP é Apenas Bibliotecas Reempacotadas: Déjà Vu Novamente

Uma discussão no Reddit argumenta que o MCP da Anthropic é essencialmente uma reembalagem de bibliotecas de programação, traçando paralelos com o design da ferramenta smolagents da Hugging Face e questionando se devemos construir novos MCPs ou melhorar a documentação das bibliotecas existentes.

OpenClawRadar
MCP Também Funciona com Modelos Locais — Ecossistema de Servidores Amadurecendo Rapidamente
News

MCP Também Funciona com Modelos Locais — Ecossistema de Servidores Amadurecendo Rapidamente

MCP não é exclusivo do Claude. Modelos locais com chamada de funções funcionam bem. Open Web UI agora tem cliente MCP básico. Modelos 13B+ lidam melhor com ferramentas de várias etapas.

OpenClawRadar