Савант Коммандер 48B: Пользовательская модель Qwen 3 со смесью экспертов, включающая 12 дистиллированных моделей

Savant Commander 48B — это кастомная модель с архитектурой Mixture-of-Experts (MOE), построенная на основе Qwen 3, которая объединяет 12 дистиллированных моделей от различных провайдеров, включая Claude, Gemini, OpenAI и Deepseek. Модель использует ручную маршрутизацию для изоляции каждого дистиллята, одновременно позволяя устанавливать связи между ними.
Ключевые особенности и архитектура
- Основана на Qwen 3 с длиной контекста 256K
- Структура MOE 4x12B (всего 48B параметров)
- Кастомная маршрутизация изолирует каждую дистиллированную модель, сохраняя межмодельные связи
- Активация по запросу — пользователи могут выбирать, какую дистиллированную модель(и) использовать
- Позволяет напрямую сравнивать различные дистиллированные модели с использованием идентичных запросов
Варианты модели и доступность
Проект включает как обычную, так и нецензурированную («Heretic») версии. Нецензурированная версия была создана путём применения процесса Heretic к каждой отдельной модели перед добавлением их в структуру MOE, а не к целой MOE.
Доступные форматы GGUF:
- Обычная версия:
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill-GGUF - Нецензурированная версия:
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored-GGUF
Исходные репозитории:
- Обычная:
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill - Нецензурированная:
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored
Практическое применение
Маршрутизация по запросу в этой модели позволяет разработчикам тестировать и сравнивать результаты различных дистиллированных моделей, используя одинаковые запросы. Функции управления и контроля документированы в карточке репозитория с подробными инструкциями.
Такой подход к архитектуре MOE предоставляет практичный способ использовать несколько специализированных моделей в рамках единой системы вывода, что особенно полезно для сравнения поведения моделей или выбора конкретных характеристик модели для различных задач.
📖 Read the full source: r/LocalLLaMA
👀 Смотрите также

CK Search: Локальный инструмент семантического поиска с интеграцией сервера MCP
CK Search — это локальный инструмент семантического поиска со встроенным MCP-сервером, который индексирует любые текстовые каталоги без зависимости от облачных сервисов. Инструмент может использоваться ИИ-агентами через MCP, а исходный материал содержит практическое руководство по настройке, преимуществам и ограничениям в сравнении с grep.

ShareMyClaudeMD: Инструмент преобразует файлы Markdown, созданные Claude, в доступные для общего доступа отрендеренные страницы
Разработчик создал sharemyclaudemd.com — бесплатный инструмент, который преобразует любой файл Markdown в живую, отрендеренную страницу с доступной для общего доступа ссылкой и QR-кодом. Инструмент решает проблему сложности обмена файлами Markdown, сгенерированными Claude, что часто требует от получателей открывать их в специальном редакторе или загружать на GitHub только для просмотра в отрендеренном виде.

tmux-claude: Мониторинг экземпляров кода Claude в панелях Tmux
tmux-claude — это инструмент, который добавляет мониторинг в реальном времени для экземпляров Claude Code в сессиях tmux. Он предоставляет строку состояния, интерактивную панель управления, улучшенный переключатель окон и уведомления на рабочем столе, считывая локальные файлы сессий без использования API.

История рейтинга ELO модели Arena AI отслеживает снижение производительности LLM с течением времени
Интерактивная панель визуализирует рейтинги ELO флагманских моделей от ведущих AI-лабораторий, показывая постепенное снижение производительности и резкие скачки при новых релизах. Инструмент динамически строит одну кривую для каждой лаборатории, отслеживая самую высокооцененную модель.