Savant Commander 48B : Un modèle personnalisé Qwen 3 à base de mélange d'experts, intégrant 12 modèles distillés

Savant Commander 48B est un modèle personnalisé Mixture-of-Experts (MOE) construit sur l'architecture Qwen 3 qui combine 12 modèles distillés provenant de divers fournisseurs incluant Claude, Gemini, OpenAI et Deepseek. Le modèle utilise un routage codé manuellement pour isoler chaque distillation tout en permettant des connexions entre elles simultanément.
Caractéristiques et architecture principales
- Basé sur Qwen 3 avec une longueur de contexte de 256K
- Structure MOE 4x12B (48 milliards de paramètres au total)
- Le routage personnalisé isole chaque modèle distillé tout en maintenant les connexions inter-modèles
- Activation contrôlée par prompt - les utilisateurs peuvent sélectionner quel(s) modèle(s) distillé(s) utiliser
- Permet la comparaison directe entre différents modèles distillés en utilisant des prompts identiques
Variantes du modèle et disponibilité
Le projet inclut à la fois des versions régulières et non censurées ("Hérétique"). La version non censurée a été créée en appliquant le processus Hérétique à chaque modèle individuel avant de les ajouter à la structure MOE, plutôt que de l'appliquer à l'ensemble du MOE.
Formats GGUF disponibles :
- Version régulière :
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill-GGUF - Version non censurée :
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored-GGUF
Dépôts sources :
- Régulier :
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill - Non censuré :
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored
Applications pratiques
Le routage contrôlé par prompt du modèle permet aux développeurs de tester et comparer les sorties de différents modèles distillés en utilisant les mêmes prompts. Les fonctions de commande et de contrôle sont documentées dans la fiche du dépôt avec des instructions détaillées.
Cette approche de l'architecture MOE offre un moyen pratique de tirer parti de plusieurs modèles spécialisés dans un cadre d'inférence unique, particulièrement utile pour comparer les comportements des modèles ou sélectionner des caractéristiques spécifiques de modèles pour différentes tâches.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Modo : IDE IA open-source avec développement piloté par les spécifications et crochets d'agents
Modo est un IDE de bureau open-source construit sur l'éditeur Void qui ajoute des flux de travail de développement pilotés par les spécifications, des crochets d'agent et des fichiers de pilotage. Il structure les invites en exigences, conception et tâches avant de générer du code.

SkyClaw : Runtime d'agent IA autonome basé sur Rust
SkyClaw est un runtime d'agent IA autonome construit en Rust avec un binaire de 7,1 Mo qui consomme 14 Mo de RAM au repos et démarre en moins d'une seconde. Il fonctionne selon cinq principes d'ingénierie incluant l'autonomie, la robustesse et une efficacité brutale.

Formateur de messages Slack : Corriger le Markdown cassé de Claude dans Slack
Un développeur a créé une compétence qui convertit le Markdown généré par Claude en un formatage Slack approprié, résolvant les problèmes où le texte en gras s'affiche avec des astérisques, les liens apparaissent bruts et les tableaux se cassent. L'outil propose à la fois un aperçu navigateur avec copier-coller HTML enrichi et une prise en charge de webhook API.

Processus d'Extraction de Voix Personnalisée pour le Code Claude avec Modèle
Un développeur partage un processus d'extraction en trois passes pour créer une compétence vocale personnalisée pour Claude Code, aboutissant à un fichier SKILL.md de 510 lignes avec des listes d'interdiction pour les tics de LLM, des règles anti-performatives et des modes vocaux spécifiques au format. Le modèle open-source fonctionne avec n'importe quelle langue en utilisant 10+ échantillons d'écriture.