TranscriptionSuite v1.1.2는 WhisperX, NeMo 및 VibeVoice 모델을 추가합니다.

✍️ OpenClawRadar📅 게시일: April 17, 2026🔗 Source
TranscriptionSuite v1.1.2는 WhisperX, NeMo 및 VibeVoice 모델을 추가합니다.
Ad

TranscriptionSuite v1.1.2 출시

완전히 로컬에서 실행되는 오픈소스 오디오 전사 애플리케이션인 TranscriptionSuite가 커뮤니티 피드백을 바탕으로 한 중요한 기능 추가와 함께 버전 1.1.2를 출시했습니다.

주요 업데이트

개발자는 이전의 faster-whisper 구현을 WhisperX로 교체하고 여러 새로운 모델 패밀리에 대한 지원을 추가했습니다:

  • WhisperX - PyAnnote를 통한 화자 분리 포함
  • NeMo 모델 - PyAnnote를 통한 화자 분리를 지원하는 Parakeet 및 Canary 모델 지원
  • VibeVoice 모델 - 내장 화자 분리를 지원하는 메인 모델과 4비트 양자화 버전 모두 지원

새로운 기능

  • 모델 관리자 - 다양한 전사 모델을 관리하기 위한 중앙 집중식 제어
  • 병렬 처리 모드 - 동시 전사 및 화자 분리
  • 단축키 제어 - 향상된 워크플로우를 위한 키보드 단축키
  • 커서 위치에 붙여넣기 - 직접 텍스트 삽입 기능
  • 24kHz 녹음 파이프라인 - VibeVoice 모델의 장점을 최대한 활용하기 위해 특별히 추가됨 (Whisper 및 NeMo 모델은 16kHz 필요)

이 애플리케이션은 이제 선택된 모델 패밀리에 따라 다른 화자 분리 접근 방식을 가진 세 가지 구별되는 전사 파이프라인을 제공합니다.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also