Script et Processus de Fusion de Modèles GGUF pour les Variantes Qwen3.5-35B

✍️ OpenClawRadar📅 Publié: April 1, 2026🔗 Source
Script et Processus de Fusion de Modèles GGUF pour les Variantes Qwen3.5-35B
Ad

Un utilisateur de Reddit a partagé un script Python et une méthode de travail pour fusionner des fichiers de modèles GGUF avec une perte minimale, ciblant spécifiquement les variantes Qwen3.5-35B. L'approche combine deux modèles existants : Qwen3.5-35B-A3B-Uncensored-HauhauCS-Aggressive de HauhauCS et Qwen3.5-35B-A3B-Claude-4.6-Opus-Reasoning-Distilled-GGUF de samuelcardillo.

Détails techniques

Le modèle fusionné est disponible en version quantifiée Q4_0 sur Hugging Face. Selon la source, le modèle affiné de samuelcardillo surpasse la version de Jackrong pour Qwen 3.5 35B.

Processus de fusion

Le script Python (disponible sur Pastebin) a été "vibecodé via Claude Opus 4.6" et prend en charge :

  • La fusion de fichiers GGUF sur Google Colab Free Tier
  • La quantification via llama-quantize
  • La quantification Q4_K_M pour les modèles 35B
  • La quantification Q8 pour les modèles 8B

L'auteur note qu'il ne peut pas créer de versions quantifiées Q8_0 ou F16 en raison des limitations d'espace disque sur Google Colab Free tier, mais suggère que d'autres peuvent modifier le script via Claude Opus pour ces quantifications.

Ad

Paramètres optimaux

Pour de meilleures performances dans LM Studio, utilisez ces paramètres :

Température : 0.7
Échantillonnage Top K : 20
Pénalité de présence : 1.5
Échantillonnage Top P : 0.8
Échantillonnage Min P : 0
Graine : 3407 ou 42

L'invite système (version complète sur Pastebin) doit inclure cette première ligne : "Vous êtes Qwen, créé par Alibaba Cloud. Vous êtes un assistant utile." L'auteur note que le modèle est moins performant sans cette ligne.

📖 Source : r/LocalLLaMA

Ad

👀 See Also

Agent Skill Harbor : Gestion des compétences native GitHub pour les équipes d'agents IA
Tools

Agent Skill Harbor : Gestion des compétences native GitHub pour les équipes d'agents IA

Agent Skill Harbor est une plateforme open-source permettant aux équipes de partager, suivre et gérer les compétences des agents IA en utilisant des flux de travail natifs GitHub. Elle collecte les compétences depuis les dépôts GitHub, suit leur provenance, prend en charge les vérifications de sécurité et publie un catalogue statique avec GitHub Actions et Pages.

OpenClawRadar
Aura Research : Un outil local compile des documents en un wiki navigable par IA avec mémoire persistante
Tools

Aura Research : Un outil local compile des documents en un wiki navigable par IA avec mémoire persistante

Aura Research est un outil open-source qui traite des documents bruts (PDF, articles, notes, code, 60+ formats) en un wiki structuré en markdown avec des articles liés, des pages de concepts et un index principal. Il compresse le tout dans une archive .aura optimisée pour la recherche RAG et fonctionne à 100% localement sans que vos données ne quittent votre machine.

OpenClawRadar
🦀
Tools

Recette OpenClaw-RL de Reef : des mises à jour de poids notées derrière une barrière de publication

La recette d'évolution des poids OpenClaw-RL de Reef traite 72 problèmes GSM8K comme 72 tâches, utilise Qwen3-4B pour les rôles de politique et de modèle de récompense de processus, avec Qwen3-32B comme étudiant, et s'exécute sur sept GPU. Elle a atteint son critère de trois passes consécutives à la session 14.

OpenClawRadar
Configurations éphémères d'OpenClaw avec sandboxing réseau et démantèlement automatique
Tools

Configurations éphémères d'OpenClaw avec sandboxing réseau et démantèlement automatique

Une configuration qui démarre OpenClaw dans une VM éphémère avec une liste d'autorisation de sortie réseau, injecte des clés API dans un stockage en mémoire vive et inclut un arrêt automatique après 2 heures. Tous les appels LLM sont enregistrés dans SQLite pour relecture.

OpenClawRadar