Harmonic-9B: Ajuste fino em duas etapas do Qwen3.5-9B para agentes de IA

O que é o Harmonic-9B?
Harmonic-9B é uma versão fine-tuned do Qwen3.5-9B especificamente projetada para aplicações de agentes de IA. O desenvolvedor está usando uma abordagem de treinamento em duas etapas: a Etapa 1 foca no treinamento de raciocínio pesado (já concluído), enquanto a Etapa 2 foca na chamada leve de ferramentas e no fine-tuning de agentes (ainda em andamento no momento do anúncio).
Detalhes Técnicos
O objetivo é combinar um raciocínio estruturado forte com um uso de ferramentas limpo e confiável, mantendo capacidades naturais de conversação. Para a Etapa 2, o desenvolvedor filtrou um conjunto de dados de traços de agentes Hermes, que foi disponibilizado como código aberto no Hugging Face.
Principais melhorias no conjunto de dados filtrado:
- Auto-correção: 6% → 63%
- Etapas de verificação: 26% → 96%
- Profundidade de pensamento: +40%
- Chamadas de ferramentas/JSON válidos: 100%
Versões quantizadas GGUF já estão disponíveis para download, embora o desenvolvedor observe que ainda não executou benchmarks adequados porque a Etapa 2 ainda está em treinamento. Verificações iniciais no checkpoint da Etapa 1 mostraram bons resultados para a estrutura de raciocínio.
Status Atual e Próximos Passos
O desenvolvedor está buscando feedback sobre como o Harmonic-9B se comporta em estruturas de agentes como OpenClaw, LangGraph e ReAct. Eles planejam compartilhar números de benchmark assim que a Etapa 2 for concluída e puderem executar avaliações adequadas de agentes. Este trabalho faz parte de uma pesquisa contínua sobre curadoria de dados de alto sinal e abordagens de fine-tuning em etapas.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Apple constrói nova arquitetura de IA sobre os modelos fundacionais Google Gemini
A Apple anunciou uma grande reformulação do Apple Intelligence, construída sobre modelos de base codesenvolvidos com o Google usando tecnologia Gemini. A nova arquitetura inclui um orquestrador, modelos no dispositivo e no servidor, e capacidades multimodais.

Equipe do MeshCore se divide: marca registrada em segredo, disputa sobre código gerado por IA
A equipe de desenvolvimento do MeshCore se divide publicamente após o colaborador Andy Kirby registrar secretamente a marca MeshCore e usar Claude Code para gerar a maioria de suas contribuições de código sem divulgação.

Agora-1: Modelo de Mundo Multiagente de Código Aberto para Simulação Compartilhada em Tempo Real
A Odyssey lança o Agora-1, um modelo de mundo que permite que até quatro agentes (humanos ou IA) compartilhem uma simulação gerada em tempo real, usando GoldenEye como ambiente de teste.

Claude.ai atualmente fora do ar, erros de API elevados — 28 de abril de 2026
Uma atualização automática de status acionada pela página oficial de status da Claude informa que o Claude.ai está indisponível e a API está com taxas elevadas de erro desde 2026-04-28T17:51:36.000Z.