Harmonic-9B: Ajuste fino em duas etapas do Qwen3.5-9B para agentes de IA

O que é o Harmonic-9B?
Harmonic-9B é uma versão fine-tuned do Qwen3.5-9B especificamente projetada para aplicações de agentes de IA. O desenvolvedor está usando uma abordagem de treinamento em duas etapas: a Etapa 1 foca no treinamento de raciocínio pesado (já concluído), enquanto a Etapa 2 foca na chamada leve de ferramentas e no fine-tuning de agentes (ainda em andamento no momento do anúncio).
Detalhes Técnicos
O objetivo é combinar um raciocínio estruturado forte com um uso de ferramentas limpo e confiável, mantendo capacidades naturais de conversação. Para a Etapa 2, o desenvolvedor filtrou um conjunto de dados de traços de agentes Hermes, que foi disponibilizado como código aberto no Hugging Face.
Principais melhorias no conjunto de dados filtrado:
- Auto-correção: 6% → 63%
- Etapas de verificação: 26% → 96%
- Profundidade de pensamento: +40%
- Chamadas de ferramentas/JSON válidos: 100%
Versões quantizadas GGUF já estão disponíveis para download, embora o desenvolvedor observe que ainda não executou benchmarks adequados porque a Etapa 2 ainda está em treinamento. Verificações iniciais no checkpoint da Etapa 1 mostraram bons resultados para a estrutura de raciocínio.
Status Atual e Próximos Passos
O desenvolvedor está buscando feedback sobre como o Harmonic-9B se comporta em estruturas de agentes como OpenClaw, LangGraph e ReAct. Eles planejam compartilhar números de benchmark assim que a Etapa 2 for concluída e puderem executar avaliações adequadas de agentes. Este trabalho faz parte de uma pesquisa contínua sobre curadoria de dados de alto sinal e abordagens de fine-tuning em etapas.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Protocolo de Convergência Quumble v5: Resultados de Experimentos com LLM de Arquitetura Cruzada
O Protocolo de Convergência Quumble v5 testa se instâncias independentes de LLM convergem para descrições de criaturas imaginárias ao receberem palavras sem sentido. Os resultados mostram que tanto Claude (Opus 4.6 e Sonnet 4.6) quanto GPT-5.3 produziram independentemente uma criatura pequena, redonda, macia, com tonalidade lavanda, bioluminescente e que emite um zumbido a partir da palavra 'quumble'.

Centros de Dados de IA Aumentam Temperaturas Locais Até 9,1°C, Revela Estudo
Um estudo da Universidade de Cambridge descobriu que os data centers de IA elevam a temperatura da superfície terrestre em média 2°C após o início das operações, com casos extremos atingindo aumentos de 9,1°C, afetando áreas de até 10 quilômetros de distância.

MCP é Apenas Bibliotecas Reempacotadas: Déjà Vu Novamente
Uma discussão no Reddit argumenta que o MCP da Anthropic é essencialmente uma reembalagem de bibliotecas de programação, traçando paralelos com o design da ferramenta smolagents da Hugging Face e questionando se devemos construir novos MCPs ou melhorar a documentação das bibliotecas existentes.

MCP Também Funciona com Modelos Locais — Ecossistema de Servidores Amadurecendo Rapidamente
MCP não é exclusivo do Claude. Modelos locais com chamada de funções funcionam bem. Open Web UI agora tem cliente MCP básico. Modelos 13B+ lidam melhor com ferramentas de várias etapas.