Савант Коммандер 48B: Пользовательская модель Qwen 3 со смесью экспертов, включающая 12 дистиллированных моделей

✍️ OpenClawRadar📅 Опубликовано: 24 марта 2026 г.🔗 Source
Савант Коммандер 48B: Пользовательская модель Qwen 3 со смесью экспертов, включающая 12 дистиллированных моделей
Ad

Savant Commander 48B — это кастомная модель с архитектурой Mixture-of-Experts (MOE), построенная на основе Qwen 3, которая объединяет 12 дистиллированных моделей от различных провайдеров, включая Claude, Gemini, OpenAI и Deepseek. Модель использует ручную маршрутизацию для изоляции каждого дистиллята, одновременно позволяя устанавливать связи между ними.

Ключевые особенности и архитектура

  • Основана на Qwen 3 с длиной контекста 256K
  • Структура MOE 4x12B (всего 48B параметров)
  • Кастомная маршрутизация изолирует каждую дистиллированную модель, сохраняя межмодельные связи
  • Активация по запросу — пользователи могут выбирать, какую дистиллированную модель(и) использовать
  • Позволяет напрямую сравнивать различные дистиллированные модели с использованием идентичных запросов
Ad

Варианты модели и доступность

Проект включает как обычную, так и нецензурированную («Heretic») версии. Нецензурированная версия была создана путём применения процесса Heretic к каждой отдельной модели перед добавлением их в структуру MOE, а не к целой MOE.

Доступные форматы GGUF:

  • Обычная версия: https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill-GGUF
  • Нецензурированная версия: https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored-GGUF

Исходные репозитории:

  • Обычная: https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill
  • Нецензурированная: https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored

Практическое применение

Маршрутизация по запросу в этой модели позволяет разработчикам тестировать и сравнивать результаты различных дистиллированных моделей, используя одинаковые запросы. Функции управления и контроля документированы в карточке репозитория с подробными инструкциями.

Такой подход к архитектуре MOE предоставляет практичный способ использовать несколько специализированных моделей в рамках единой системы вывода, что особенно полезно для сравнения поведения моделей или выбора конкретных характеристик модели для различных задач.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Смотрите также

CK Search: Локальный инструмент семантического поиска с интеграцией сервера MCP
Инструменты

CK Search: Локальный инструмент семантического поиска с интеграцией сервера MCP

CK Search — это локальный инструмент семантического поиска со встроенным MCP-сервером, который индексирует любые текстовые каталоги без зависимости от облачных сервисов. Инструмент может использоваться ИИ-агентами через MCP, а исходный материал содержит практическое руководство по настройке, преимуществам и ограничениям в сравнении с grep.

OpenClawRadar
ShareMyClaudeMD: Инструмент преобразует файлы Markdown, созданные Claude, в доступные для общего доступа отрендеренные страницы
Инструменты

ShareMyClaudeMD: Инструмент преобразует файлы Markdown, созданные Claude, в доступные для общего доступа отрендеренные страницы

Разработчик создал sharemyclaudemd.com — бесплатный инструмент, который преобразует любой файл Markdown в живую, отрендеренную страницу с доступной для общего доступа ссылкой и QR-кодом. Инструмент решает проблему сложности обмена файлами Markdown, сгенерированными Claude, что часто требует от получателей открывать их в специальном редакторе или загружать на GitHub только для просмотра в отрендеренном виде.

OpenClawRadar
tmux-claude: Мониторинг экземпляров кода Claude в панелях Tmux
Инструменты

tmux-claude: Мониторинг экземпляров кода Claude в панелях Tmux

tmux-claude — это инструмент, который добавляет мониторинг в реальном времени для экземпляров Claude Code в сессиях tmux. Он предоставляет строку состояния, интерактивную панель управления, улучшенный переключатель окон и уведомления на рабочем столе, считывая локальные файлы сессий без использования API.

OpenClawRadar
История рейтинга ELO модели Arena AI отслеживает снижение производительности LLM с течением времени
Инструменты

История рейтинга ELO модели Arena AI отслеживает снижение производительности LLM с течением времени

Интерактивная панель визуализирует рейтинги ELO флагманских моделей от ведущих AI-лабораторий, показывая постепенное снижение производительности и резкие скачки при новых релизах. Инструмент динамически строит одну кривую для каждой лаборатории, отслеживая самую высокооцененную модель.

OpenClawRadar