Script et Processus de Fusion de Modèles GGUF pour les Variantes Qwen3.5-35B

✍️ OpenClawRadar📅 Publié: April 1, 2026🔗 Source
Script et Processus de Fusion de Modèles GGUF pour les Variantes Qwen3.5-35B
Ad

Un utilisateur de Reddit a partagé un script Python et une méthode de travail pour fusionner des fichiers de modèles GGUF avec une perte minimale, ciblant spécifiquement les variantes Qwen3.5-35B. L'approche combine deux modèles existants : Qwen3.5-35B-A3B-Uncensored-HauhauCS-Aggressive de HauhauCS et Qwen3.5-35B-A3B-Claude-4.6-Opus-Reasoning-Distilled-GGUF de samuelcardillo.

Détails techniques

Le modèle fusionné est disponible en version quantifiée Q4_0 sur Hugging Face. Selon la source, le modèle affiné de samuelcardillo surpasse la version de Jackrong pour Qwen 3.5 35B.

Processus de fusion

Le script Python (disponible sur Pastebin) a été "vibecodé via Claude Opus 4.6" et prend en charge :

  • La fusion de fichiers GGUF sur Google Colab Free Tier
  • La quantification via llama-quantize
  • La quantification Q4_K_M pour les modèles 35B
  • La quantification Q8 pour les modèles 8B

L'auteur note qu'il ne peut pas créer de versions quantifiées Q8_0 ou F16 en raison des limitations d'espace disque sur Google Colab Free tier, mais suggère que d'autres peuvent modifier le script via Claude Opus pour ces quantifications.

Ad

Paramètres optimaux

Pour de meilleures performances dans LM Studio, utilisez ces paramètres :

Température : 0.7
Échantillonnage Top K : 20
Pénalité de présence : 1.5
Échantillonnage Top P : 0.8
Échantillonnage Min P : 0
Graine : 3407 ou 42

L'invite système (version complète sur Pastebin) doit inclure cette première ligne : "Vous êtes Qwen, créé par Alibaba Cloud. Vous êtes un assistant utile." L'auteur note que le modèle est moins performant sans cette ligne.

📖 Source : r/LocalLLaMA

Ad

👀 See Also

Méthodologie open-source pour un partenariat agentique avec Claude
Tools

Méthodologie open-source pour un partenariat agentique avec Claude

Un développeur a publié un article de 25 000 mots et a mis en open source des modèles pour construire un système de partenariat persistant avec Claude, utilisant une mémoire partagée entre les sessions, une surveillance cognitive et une consultation multi-IA.

OpenClawRadar
Approche de l'amélioration autonome de la mémoire dans les agents d'IA locaux
Tools

Approche de l'amélioration autonome de la mémoire dans les agents d'IA locaux

Un développeur partage son approche de la mémoire persistente pour les agents d'IA locaux en utilisant des fichiers markdown comme source de vérité, l'évaluation d'épisodes avec des règles basées sur la confiance, et l'augmentation de la confiance basée sur les modèles d'approbation.

OpenClawRadar
Open Source Claude Code Skills pour un Contenu de Réseaux Sociaux Personnalisé
Tools

Open Source Claude Code Skills pour un Contenu de Réseaux Sociaux Personnalisé

Un développeur a mis en open source 13 compétences Claude Code qui aident Claude à rédiger du contenu pour les réseaux sociaux avec votre propre voix. Les compétences incluent des outils de définition du contexte, de stratégie, de création et d'analyse pour LinkedIn, Twitter/X, Threads et Bluesky.

OpenClawRadar
SkillMesh : Routeur compatible MCP pour les grands catalogues d'outils réduit la taille du contexte de 70 %
Tools

SkillMesh : Routeur compatible MCP pour les grands catalogues d'outils réduit la taille du contexte de 70 %

SkillMesh est un routeur compatible MCP qui récupère uniquement les cartes d'expert pertinentes pour les requêtes des agents IA, réduisant la taille du contexte de 70 % et améliorant la sélection d'outils. Il prend en charge Claude via un serveur MCP, des bundles de compétences Codex et des schémas de fonction de style OpenAI.

OpenClawRadar