Savant Commander 48B:12の蒸留モデルを統合したカスタムQwen 3 Mixture-of-Expertsモデル

Savant Commander 48Bは、Claude、Gemini、OpenAI、Deepseekなどのさまざまなプロバイダーから12の蒸留モデルを組み合わせた、Qwen 3アーキテクチャを基に構築されたカスタムMixture-of-Experts(MOE)モデルです。このモデルは、各蒸留モデルを分離しながら同時にそれらの間の接続を維持する手動コーディングルーティングを使用しています。
主な特徴とアーキテクチャ
- 256Kコンテキスト長のQwen 3を基に構築
- 4x12B MOE構造(総パラメータ数48B)
- カスタムルーティングにより各蒸留モデルを分離しながらモデル間接続を維持
- プロンプト制御によるアクティベーション - ユーザーは使用する蒸留モデルを選択可能
- 同一プロンプトを使用した異なる蒸留モデル間の直接比較を可能にします
モデルバリアントと入手可能性
このプロジェクトには、通常版と非検閲版(「Heretic」)の両方が含まれています。非検閲版は、MOE全体に適用するのではなく、各モデルにHereticプロセスを適用してからMOE構造に追加することで作成されました。
利用可能なGGUF形式:
- 通常版:
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill-GGUF - 非検閲版:
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored-GGUF
ソースリポジトリ:
- 通常版:
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill - 非検閲版:
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored
実用的な応用
このモデルのプロンプト制御ルーティングにより、開発者は同じプロンプトを使用して異なる蒸留モデルからの出力をテストおよび比較できます。コマンドおよび制御機能は、詳細な手順とともにリポジトリカードに文書化されています。
このMOEアーキテクチャへのアプローチは、特にモデルの動作を比較したり、異なるタスクに対して特定のモデル特性を選択したりする際に有用な、単一の推論フレームワーク内で複数の専門モデルを活用する実用的な方法を提供します。
📖 Read the full source: r/LocalLLaMA
👀 See Also

AIコーディングエージェントのための再帰的自己改善フレームワーク(Claude Code使用)
オープンソースのフレームワークにより、AIコーディングエージェントがClaude Codeを使用して再帰的に自己改善できるようになります。このシステムはエージェントの実行トレースを分析し、失敗パターンを特定して修正を実装し、1回のテストサイクルで25%の性能向上を達成しました。

Claude-switch CLIツールは、使用制限に達した際にClaude Maxアカウントを自動で切り替えることを可能にします。
開発者は、Claude Codeの利用制限に達した際にアカウントを切り替えるために、macOS Keychainから認証情報を保存・復元する250行のbash CLIツール「claude-switch」を構築しました。このツールはブラウザでの再認証を不要にし、ワークフローの連続性を維持します。

SLOPプラグインがOpenClawエージェントにリアルタイムアプリ状態認識機能を追加
新しいOpenClawプラグインがSLOP(State Layer for Observable Programs)と統合され、AIエージェントがアプリケーションの状態とコンテキストに応じたアクションに構造化されたアクセスを得られるようになりました。このプラグインは、~/.slop/providers/とChrome拡張機能ブリッジを通じてSLOP対応アプリを自動的に発見します。

Claudeコードのためのマルチエージェントアーキテクチャを用いた「研究チーム・イン・ザ・ボックス」フレームワーク
開発者がClaude Code向けのマルチエージェント研究フレームワークを作成しました。このフレームワークはOpus 4.6を活用し、research-clabというプラグインを通じて専門エージェントを調整します。ガイド付きのQ&Aプロセスで展開され、11のスキル、エージェント定義、複雑な研究プロジェクトを管理するための構造化ディレクトリを含んでいます。