Qwen3.5-35B-A3B-UD-Q6_K_XL Testé dans les flux de travail de développement en production

✍️ OpenClawRadar📅 Publié: February 28, 2026🔗 Source
Qwen3.5-35B-A3B-UD-Q6_K_XL Testé dans les flux de travail de développement en production
Ad

Un développeur sur r/LocalLLaMA a partagé des résultats de test détaillés du modèle Qwen3.5-35B-A3B-UD-Q6_K_XL dans des scénarios de développement en production. L'utilisateur a réalisé à la fois des tests de benchmark et des applications pratiques sur des projets clients réels.

Benchmarks de Performance

Le modèle a obtenu des scores de benchmark de 1504pp2048 et 47.71 tg256. La vitesse de génération de tokens était solide lorsqu'elle était répartie sur deux GPU, et augmentait à 80 tokens par seconde (tps) lors de l'exécution sur un seul GPU.

Méthodologie de Test en Production

Le développeur a testé le modèle sur cinq projets différents en utilisant Git Worktrees pour revenir à des spécifications et fonctionnalités connues. Les spécifications pour ces tests ont été générées par Claude, le développeur utilisant un plan Max Pro depuis un an.

  • Testé sur des projets JavaScript, Go et Rust
  • Utilisé Git Worktrees pour le contrôle de version pendant les tests
  • La plupart des "bugs" nécessitaient seulement des ajustements de 5 minutes ou pouvaient être corrigés avec une seconde requête
  • Comparé l'expérience à l'utilisation de Sonnet 4
Ad

Résultats Pratiques et Implications Commerciales

Le développeur a rapporté que Qwen3.5 "a tout déchiré" pour le travail qu'il effectue, notant particulièrement de solides performances sur les projets Go et Rust. Cela a conduit à sérieusement envisager de passer de modèles basés sur API à une approche hybride : utiliser des modèles SOTA via API pour la génération de spécifications et les revues, tout en utilisant des modèles locaux pour le travail de développement.

Les tests ont soulevé des questions sur l'investissement matériel par rapport aux coûts d'abonnement. Le développeur a déjà dépensé 2 000 $ pour Claude Pro Max depuis juin 2025, avec des coûts potentiels atteignant 6 800 $ d'ici 2027 si les abonnements continuent. Cela a conduit à envisager l'achat d'un RTX 6000 Pro comme investissement commercial.

Le développeur utilisait auparavant Qwen Coder pour la complétion par tabulation, mais a constaté que Qwen3.5 amène les capacités des modèles locaux à un nouveau niveau pour un usage en production.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

Utilisateur de Reddit mesure la surcharge des tokens MCP : 67 000 tokens consommés avant toute question
Tools

Utilisateur de Reddit mesure la surcharge des tokens MCP : 67 000 tokens consommés avant toute question

Un développeur a mesuré la surcharge de jetons de son serveur MCP à 67 000 jetons consommés avant même de poser une seule question, avec Playwright MCP utilisant 13 600 jetons et GitHub MCP utilisant 18 000 jetons en veille. Il a remplacé MCP par des compétences et des outils CLI pour réduire les coûts de contexte.

OpenClawRadar
Logseq Brain v0.6.0 : Plugin de mémoire persistante pour Claude Code avec journal de bord et lectures ciblées par section
Tools

Logseq Brain v0.6.0 : Plugin de mémoire persistante pour Claude Code avec journal de bord et lectures ciblées par section

Logseq Brain v0.6.0 ajoute un journal de bord pour toutes les opérations, des lectures ciblées par section pour économiser des tokens, et une divulgation progressive pour les fichiers de compétences.

OpenClawRadar
Présentation de OneTool MCP : un outil polyvalent open source pour les développeurs.
Tools

Présentation de OneTool MCP : un outil polyvalent open source pour les développeurs.

OneTool MCP, développé avec Claude IA, offre aux développeurs plus de 100 outils pour des tâches telles que les recherches web, les mises à jour de bibliothèques et la gestion de fichiers, sans taxe d'outil ni pourriture contextuelle.

OpenClawRadar
Automatisation des Notes de Version de Claude Desktop à partir d'Applications Electron Minifiées
Tools

Automatisation des Notes de Version de Claude Desktop à partir d'Applications Electron Minifiées

Un développeur a créé un pipeline automatisé utilisant Claude Sonnet et Opus 4.6 pour générer des notes de version pour Claude Desktop sur Linux, comblant ainsi l'absence de notes de version officielles de la part d'Anthropic. Le système extrait, normalise et analyse le code minifié de l'application Electron dans le cadre d'un flux de travail CI/CD.

OpenClawRadar