사벤트 커맨더 48B: 12개의 증류 모델로 구성된 맞춤형 Qwen 3 전문가 혼합 모델

Savant Commander 48B는 Claude, Gemini, OpenAI, Deepseek 등 다양한 제공업체의 12개 증류 모델을 결합한 Qwen 3 아키텍처 기반의 맞춤형 Mixture-of-Experts(MOE) 모델입니다. 이 모델은 각 증류 모델을 분리하면서 동시에 모델 간 연결을 유지하기 위해 수동 코딩된 라우팅을 사용합니다.
주요 기능 및 아키텍처
- 256K 컨텍스트 길이의 Qwen 3 기반
- 4x12B MOE 구조(총 48B 매개변수)
- 맞춤형 라우팅으로 각 증류 모델을 분리하면서 모델 간 연결 유지
- 프롬프트 제어 활성화 - 사용자가 사용할 증류 모델 선택 가능
- 동일한 프롬프트를 사용하여 서로 다른 증류 모델 간 직접 비교 가능
모델 변형 및 가용성
이 프로젝트에는 일반 버전과 검열되지 않은("Heretic") 버전이 포함되어 있습니다. 검열되지 않은 버전은 전체 MOE에 적용하는 대신 각 개별 모델에 Heretic 프로세스를 적용한 후 MOE 구조에 추가하여 생성되었습니다.
사용 가능한 GGUF 형식:
- 일반 버전:
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill-GGUF - 검열되지 않은 버전:
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored-GGUF
소스 저장소:
- 일반:
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-GATED-12x-Closed-Open-Source-Distill - 검열되지 않은:
https://huggingface.co/DavidAU/Qwen3-48B-A4B-Savant-Commander-Distill-12X-Closed-Open-Heretic-Uncensored
실제 응용
이 모델의 프롬프트 제어 라우팅을 통해 개발자는 동일한 프롬프트를 사용하여 서로 다른 증류 모델의 출력을 테스트하고 비교할 수 있습니다. 명령 및 제어 기능은 저장소 카드에 자세한 지침과 함께 문서화되어 있습니다.
이러한 MOE 아키텍처 접근 방식은 단일 추론 프레임워크 내에서 여러 전문 모델을 활용하는 실용적인 방법을 제공하며, 특히 모델 동작 비교나 다양한 작업에 대한 특정 모델 특성 선택에 유용합니다.
📖 Read the full source: r/LocalLLaMA
👀 See Also

LUMA SOUL: 클로드 기반 영구 생성자 잠금 및 투명 메모리를 갖춘 마인드
LUMA SOUL은 각 AI 마인드가 초상화, 음성, 소울 문서를 갖는 프레즌스 플랫폼입니다. 핵심 설계: 창작자는 제출 시 영구적으로 편집 권한을 잃고, 메모리는 완전히 투명합니다.

블라인드스팟 MCP: AI 코딩 에이전트를 위한 외부 두뇌
Blindspot MCP는 tree-sitter와 SQLite를 사용하여 전체 코드베이스를 인덱싱하여 AI 코딩 에이전트가 파일 간의 심볼, 의존성, 관계를 이해하고, 직접적인 컨텍스트 외부의 코드를 손상시키는 변경을 방지하는 도구입니다.

ClaudeHive: 병렬 Claude 코드 세션 관리를 위한 웹 UI
ClaudeHive는 병렬 Claude Code 세션을 처리하는 웹 UI로, 사용자가 자리 표시자가 있는 프롬프트 템플릿을 정의하고, 구성 가능한 동시성을 통해 여러 입력에 걸쳐 일괄 실행하며, 모든 결과를 한 곳에서 검토할 수 있도록 합니다. 여기에는 관리자 에이전트가 작업자 에이전트를 생성하고 조정할 수 있는 CLI 도구도 포함됩니다.

개리 탄의 gstack: 클로드 코드를 위한 오픈 소스 AI 에이전트 프레임워크
개리 탄의 gstack은 클로드 코드를 계획, 설계, 엔지니어링, 리뷰, QA, 릴리스 관리를 위한 13개의 전문가 슬래시 명령어를 가진 가상 엔지니어링 팀으로 변환하는 오픈 소스 소프트웨어 팩토리입니다.