Savant Commander 48B : Un modèle personnalisé Qwen 3 à base de mélange d'experts, intégrant 12 modèles distillés

✍️ OpenClawRadar📅 Publié: March 24, 2026🔗 Source
Savant Commander 48B : Un modèle personnalisé Qwen 3 à base de mélange d'experts, intégrant 12 modèles distillés
Ad

Savant Commander 48B est un modèle personnalisé Mixture-of-Experts (MOE) construit sur l'architecture Qwen 3 qui combine 12 modèles distillés provenant de divers fournisseurs incluant Claude, Gemini, OpenAI et Deepseek. Le modèle utilise un routage codé manuellement pour isoler chaque distillation tout en permettant des connexions entre elles simultanément.

Caractéristiques et architecture principales

  • Basé sur Qwen 3 avec une longueur de contexte de 256K
  • Structure MOE 4x12B (48 milliards de paramètres au total)
  • Le routage personnalisé isole chaque modèle distillé tout en maintenant les connexions inter-modèles
  • Activation contrôlée par prompt - les utilisateurs peuvent sélectionner quel(s) modèle(s) distillé(s) utiliser
  • Permet la comparaison directe entre différents modèles distillés en utilisant des prompts identiques
Ad

Variantes du modèle et disponibilité

Le projet inclut à la fois des versions régulières et non censurées ("Hérétique"). La version non censurée a été créée en appliquant le processus Hérétique à chaque modèle individuel avant de les ajouter à la structure MOE, plutôt que de l'appliquer à l'ensemble du MOE.

Formats GGUF disponibles :

  • Version régulière : https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill-GGUF
  • Version non censurée : https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored-GGUF

Dépôts sources :

  • Régulier : https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill
  • Non censuré : https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored

Applications pratiques

Le routage contrôlé par prompt du modèle permet aux développeurs de tester et comparer les sorties de différents modèles distillés en utilisant les mêmes prompts. Les fonctions de commande et de contrôle sont documentées dans la fiche du dépôt avec des instructions détaillées.

Cette approche de l'architecture MOE offre un moyen pratique de tirer parti de plusieurs modèles spécialisés dans un cadre d'inférence unique, particulièrement utile pour comparer les comportements des modèles ou sélectionner des caractéristiques spécifiques de modèles pour différentes tâches.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Radicle 1.8.0 publié : Forge de code décentralisée pair-à-pair construite sur Git
Tools

Radicle 1.8.0 publié : Forge de code décentralisée pair-à-pair construite sur Git

Radicle 1.8.0 propose une forge de code souveraine et pair-à-pair sur Git, avec CLI, interface web et client desktop. Les dépôts se répliquent entre pairs via NoiseXK et un protocole gossip personnalisé – pas de serveur central.

OpenClawRadar
Passerelle MCP pour un accès distant sécurisé aux outils internes
Tools

Passerelle MCP pour un accès distant sécurisé aux outils internes

Une passerelle MCP open-source agrège plusieurs serveurs d'outils MCP en une seule connexion, permettant un accès sécurisé via Claude Desktop sans exposer de points de terminaison publics. Elle utilise OpenZiti/zrok pour un réseau de confiance zéro et ne nécessite qu'une seule entrée de configuration avec un jeton de partage.

OpenClawRadar
Modèle de Chat Qwen 3.5 Publié avec 21 Corrections de Bugs pour les Flux de Travail d'Agent
Tools

Modèle de Chat Qwen 3.5 Publié avec 21 Corrections de Bugs pour les Flux de Travail d'Agent

Un développeur a publié un modèle de chat corrigé pour les modèles Qwen 3.5, résolvant 21 bogues, notamment des plantages lors des appels d'outils, la séparation des appels parallèles et la stabilité des boucles d'agents. Il s'agit d'un remplacement direct testé sur llama.cpp, Open WebUI, vLLM et d'autres plateformes.

OpenClawRadar
Plugin OKed : OpenClaw demande votre téléphone avant des actions destructrices
Tools

Plugin OKed : OpenClaw demande votre téléphone avant des actions destructrices

Un nouveau plugin appelé OKed se branche sur le before_tool_call d'OpenClaw pour intercepter les commandes destructrices (emails, suppressions, paiements) et envoyer des demandes d'approbation à votre téléphone ou Telegram.

OpenClawRadar