TranscriptionSuite v1.1.2 fügt WhisperX-, NeMo- und VibeVoice-Modelle hinzu.

✍️ OpenClawRadar📅 Veröffentlicht: 17. April 2026🔗 Source
TranscriptionSuite v1.1.2 fügt WhisperX-, NeMo- und VibeVoice-Modelle hinzu.
Ad

TranscriptionSuite v1.1.2 Veröffentlichung

TranscriptionSuite, eine vollständig lokale und quelloffene Audio-Transkriptionsanwendung, hat Version 1.1.2 mit bedeutenden Funktionserweiterungen basierend auf Community-Feedback veröffentlicht.

Wichtige Aktualisierungen

Der Entwickler ersetzte die vorherige faster-whisper-Implementierung durch WhisperX und fügte Unterstützung für mehrere neue Modellfamilien hinzu:

  • WhisperX - Enthält Diarisierung über PyAnnote
  • NeMo-Modelle - Unterstützung für Parakeet- und Canary-Modelle mit Diarisierung über PyAnnote
  • VibeVoice-Modelle - Unterstützung für Hauptmodell und 4-Bit-quantisierte Versionen mit integrierter Diarisierung
Ad

Neue Funktionen

  • Modell-Manager - Zentrale Steuerung zur Verwaltung verschiedener Transkriptionsmodelle
  • Paralleler Verarbeitungsmodus - Gleichzeitige Transkription und Diarisierung
  • Tastenkürzel-Steuerungen - Tastenkombinationen für verbesserte Arbeitsabläufe
  • Einfügen an Cursorposition - Direkte Texteinfügefunktion
  • 24kHz-Aufnahmepipeline - Speziell hinzugefügt, um die Vorteile von VibeVoice-Modellen voll auszuschöpfen (Whisper- und NeMo-Modelle benötigen 16kHz)

Die Anwendung bietet nun drei verschiedene Transkriptions-Pipelines, jeweils mit unterschiedlichen Diarisierungsansätzen je nach ausgewählter Modellfamilie.

📖 Quelle vollständig lesen: r/LocalLLaMA

Ad

👀 Siehe auch