Savant Commander 48B : Un modèle personnalisé Qwen 3 à base de mélange d'experts, intégrant 12 modèles distillés

✍️ OpenClawRadar📅 Publié: March 24, 2026🔗 Source
Savant Commander 48B : Un modèle personnalisé Qwen 3 à base de mélange d'experts, intégrant 12 modèles distillés
Ad

Savant Commander 48B est un modèle personnalisé Mixture-of-Experts (MOE) construit sur l'architecture Qwen 3 qui combine 12 modèles distillés provenant de divers fournisseurs incluant Claude, Gemini, OpenAI et Deepseek. Le modèle utilise un routage codé manuellement pour isoler chaque distillation tout en permettant des connexions entre elles simultanément.

Caractéristiques et architecture principales

  • Basé sur Qwen 3 avec une longueur de contexte de 256K
  • Structure MOE 4x12B (48 milliards de paramètres au total)
  • Le routage personnalisé isole chaque modèle distillé tout en maintenant les connexions inter-modèles
  • Activation contrôlée par prompt - les utilisateurs peuvent sélectionner quel(s) modèle(s) distillé(s) utiliser
  • Permet la comparaison directe entre différents modèles distillés en utilisant des prompts identiques
Ad

Variantes du modèle et disponibilité

Le projet inclut à la fois des versions régulières et non censurées ("Hérétique"). La version non censurée a été créée en appliquant le processus Hérétique à chaque modèle individuel avant de les ajouter à la structure MOE, plutôt que de l'appliquer à l'ensemble du MOE.

Formats GGUF disponibles :

  • Version régulière : https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill-GGUF
  • Version non censurée : https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored-GGUF

Dépôts sources :

  • Régulier : https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill
  • Non censuré : https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored

Applications pratiques

Le routage contrôlé par prompt du modèle permet aux développeurs de tester et comparer les sorties de différents modèles distillés en utilisant les mêmes prompts. Les fonctions de commande et de contrôle sont documentées dans la fiche du dépôt avec des instructions détaillées.

Cette approche de l'architecture MOE offre un moyen pratique de tirer parti de plusieurs modèles spécialisés dans un cadre d'inférence unique, particulièrement utile pour comparer les comportements des modèles ou sélectionner des caractéristiques spécifiques de modèles pour différentes tâches.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Modo : IDE IA open-source avec développement piloté par les spécifications et crochets d'agents
Tools

Modo : IDE IA open-source avec développement piloté par les spécifications et crochets d'agents

Modo est un IDE de bureau open-source construit sur l'éditeur Void qui ajoute des flux de travail de développement pilotés par les spécifications, des crochets d'agent et des fichiers de pilotage. Il structure les invites en exigences, conception et tâches avant de générer du code.

OpenClawRadar
SkyClaw : Runtime d'agent IA autonome basé sur Rust
Tools

SkyClaw : Runtime d'agent IA autonome basé sur Rust

SkyClaw est un runtime d'agent IA autonome construit en Rust avec un binaire de 7,1 Mo qui consomme 14 Mo de RAM au repos et démarre en moins d'une seconde. Il fonctionne selon cinq principes d'ingénierie incluant l'autonomie, la robustesse et une efficacité brutale.

OpenClawRadar
Formateur de messages Slack : Corriger le Markdown cassé de Claude dans Slack
Tools

Formateur de messages Slack : Corriger le Markdown cassé de Claude dans Slack

Un développeur a créé une compétence qui convertit le Markdown généré par Claude en un formatage Slack approprié, résolvant les problèmes où le texte en gras s'affiche avec des astérisques, les liens apparaissent bruts et les tableaux se cassent. L'outil propose à la fois un aperçu navigateur avec copier-coller HTML enrichi et une prise en charge de webhook API.

OpenClawRadar
Processus d'Extraction de Voix Personnalisée pour le Code Claude avec Modèle
Tools

Processus d'Extraction de Voix Personnalisée pour le Code Claude avec Modèle

Un développeur partage un processus d'extraction en trois passes pour créer une compétence vocale personnalisée pour Claude Code, aboutissant à un fichier SKILL.md de 510 lignes avec des listes d'interdiction pour les tics de LLM, des règles anti-performatives et des modes vocaux spécifiques au format. Le modèle open-source fonctionne avec n'importe quelle langue en utilisant 10+ échantillons d'écriture.

OpenClawRadar