Qwen3.5-35B-A3B-UD-Q6_K_XL Testado em Fluxos de Trabalho de Desenvolvimento de Produção

Um desenvolvedor no r/LocalLLaMA compartilhou resultados detalhados de testes do modelo Qwen3.5-35B-A3B-UD-Q6_K_XL em cenários de desenvolvimento de produção. O usuário conduziu tanto testes de benchmark quanto aplicação prática em projetos reais de clientes.
Benchmarks de Desempenho
O modelo alcançou pontuações de benchmark de 1504pp2048 e 47.71 tg256. A velocidade de geração de tokens foi sólida quando distribuída entre duas GPUs, e aumentou para 80 tokens por segundo (tps) quando executado em uma única GPU.
Metodologia de Testes em Produção
O desenvolvedor testou o modelo em cinco projetos diferentes usando Git Worktrees para reverter para especificações e recursos conhecidos. As especificações para esses testes foram geradas pelo Claude, com o desenvolvedor usando um plano Max Pro no último ano.
- Testado em projetos JavaScript, Go e Rust
- Usou Git Worktrees para controle de versão durante os testes
- A maioria dos "bugs" exigiu apenas ajustes de 5 minutos ou pôde ser corrigida com um segundo prompt
- Comparou a experiência com o uso do Sonnet 4
Resultados Práticos e Implicações de Negócios
O desenvolvedor relatou que o Qwen3.5 "acertou em cheio" para o trabalho que realiza, observando especialmente o forte desempenho em projetos Go e Rust. Isso levou a uma consideração séria de mudar de modelos baseados em API para uma abordagem híbrida: usar modelos SOTA via API para geração de especificações e revisões, enquanto usa modelos locais para trabalho de desenvolvimento.
Os testes levantaram questões sobre investimento em hardware versus custos de assinatura. O desenvolvedor já gastou US$ 2.000 no Claude Pro Max desde junho de 2025, com custos potenciais chegando a US$ 6.800 até 2027 se as assinaturas continuarem. Isso levou à consideração de comprar um RTX 6000 Pro como investimento de negócios.
O desenvolvedor vinha usando o Qwen Coder para conclusão de tabulação anteriormente, mas descobriu que o Qwen3.5 eleva as capacidades dos modelos locais a um novo nível para uso em produção.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Godogen: Habilidades de Código Claude para Geração Completa de Jogos Godot
Godogen é um pipeline de código aberto que utiliza as habilidades do Claude Code para gerar projetos completos e jogáveis do Godot 4 a partir de prompts de texto. Ele lida com o design de arquitetura, geração de assets 2D/3D, escrita de GDScript e testes visuais de QA, abordando gargalos de engenharia específicos como a escassez de dados de treinamento para GDScript e problemas de estado em tempo de compilação versus tempo de execução.

Problemas de Compromisso: Uma Ferramenta que Analisa e 'Enterra' Repositórios Inacabados do GitHub
Um desenvolvedor criou uma ferramenta chamada Commitment Issues que analisa repositórios do GitHub para determinar se foram abandonados, gera um 'certificado de óbito' e extrai a mensagem do último commit como 'últimas palavras'. A ferramenta usa heurísticas como frequência de commits, última atividade e estrelas versus momentum, e foi prototipada usando Claude.

ClaudeOrb: Extensão do Chrome Monitora o Uso da API Claude em Tempo Real
Um desenvolvedor criou o ClaudeOrb, uma extensão gratuita do Chrome que exibe a porcentagem da sessão do Claude, limites semanais, temporizadores de contagem regressiva, custos do Claude Code e tendências de gastos de 7 dias. A ferramenta foi criada usando o Claude Code após atingir limites de taxa sem aviso.

IUM: Índice de Símbolos MCP reduz uso de tokens de IA em 15,9x comparado ao grep
IUM indexa bases de código em uma matriz SQLite de eventos de símbolo, expondo coordenadas exatas de arquivo:linha, rastreamento de grafo de chamadas e busca semântica via MCP. Benchmark contra DataFusion (1.538 arquivos) mostra 15,9x menos tokens que grep para consultas equivalentes.