Harmonic-9B: Ajuste fino em duas etapas do Qwen3.5-9B para agentes de IA

✍️ OpenClawRadar📅 Publicado: April 15, 2026🔗 Source
Harmonic-9B: Ajuste fino em duas etapas do Qwen3.5-9B para agentes de IA
Ad

O que é o Harmonic-9B?

Harmonic-9B é uma versão fine-tuned do Qwen3.5-9B especificamente projetada para aplicações de agentes de IA. O desenvolvedor está usando uma abordagem de treinamento em duas etapas: a Etapa 1 foca no treinamento de raciocínio pesado (já concluído), enquanto a Etapa 2 foca na chamada leve de ferramentas e no fine-tuning de agentes (ainda em andamento no momento do anúncio).

Detalhes Técnicos

O objetivo é combinar um raciocínio estruturado forte com um uso de ferramentas limpo e confiável, mantendo capacidades naturais de conversação. Para a Etapa 2, o desenvolvedor filtrou um conjunto de dados de traços de agentes Hermes, que foi disponibilizado como código aberto no Hugging Face.

Principais melhorias no conjunto de dados filtrado:

  • Auto-correção: 6% → 63%
  • Etapas de verificação: 26% → 96%
  • Profundidade de pensamento: +40%
  • Chamadas de ferramentas/JSON válidos: 100%

Versões quantizadas GGUF já estão disponíveis para download, embora o desenvolvedor observe que ainda não executou benchmarks adequados porque a Etapa 2 ainda está em treinamento. Verificações iniciais no checkpoint da Etapa 1 mostraram bons resultados para a estrutura de raciocínio.

Ad

Status Atual e Próximos Passos

O desenvolvedor está buscando feedback sobre como o Harmonic-9B se comporta em estruturas de agentes como OpenClaw, LangGraph e ReAct. Eles planejam compartilhar números de benchmark assim que a Etapa 2 for concluída e puderem executar avaliações adequadas de agentes. Este trabalho faz parte de uma pesquisa contínua sobre curadoria de dados de alto sinal e abordagens de fine-tuning em etapas.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Arnês de Agente Fora da Sandbox: Execução Durável & Inicializações a Frio
News

Arnês de Agente Fora da Sandbox: Execução Durável & Inicializações a Frio

Executar o loop do agente fora do sandbox isola as credenciais, permite a suspensão do sandbox e simplifica o compartilhamento entre vários usuários, mas requer resolver a execução durável e a latência de inicialização a frio.

OpenClawRadar
Crítica da Abstração de Limites e Abordagem de Integração de Serviços do MCP
News

Crítica da Abstração de Limites e Abordagem de Integração de Serviços do MCP

Uma discussão no Reddit critica o MCP por agrupar acesso à API, ferramentas eficientes e conhecimento de domínio em uma única camada, argumentando que isso cria interfaces limitadas em comparação com as APIs subjacentes. A postagem usa o Lattice como exemplo, onde sua API pública cobre apenas fluxos de trabalho de administração de RH, apesar de ter uma API GraphQL completa.

OpenClawRadar
Desenvolvedor Prefere Qwen3.5-27B a Modelos Proprietários por Seu Modo de Falha
News

Desenvolvedor Prefere Qwen3.5-27B a Modelos Proprietários por Seu Modo de Falha

Um desenvolvedor no r/LocalLLaMA relata preferir o Qwen3.5-27B em vez do Gemini 3.1 Pro e GPT-5.3 Codex porque ele desiste de tarefas problemáticas em vez de gerar código potencialmente perigoso, como scripts Perl ou NodeJS sem restrições.

OpenClawRadar
Kimi K2.6 vs Claude Opus 4.7: Um Duelo Prático de Programação em um Mod Minetest com Integração ao Google Sheets
News

Kimi K2.6 vs Claude Opus 4.7: Um Duelo Prático de Programação em um Mod Minetest com Integração ao Google Sheets

Um desenvolvedor testou Kimi K2.6 e Claude Opus 4.7 na criação de um mod de quadro de avisos para Minetest com backend TypeScript e registro no Google Sheets. Opus foi bem-sucedido em ambas as tarefas; Kimi passou na tarefa local, mas falhou na integração. Custos: Opus ~$3,59 local, $16,03 integrado; Kimi $0,39 local, $5,03 (falhou).

OpenClawRadar