Sonicker: Voice-Cloning-Web-App, erstellt mit Claude Code in 4 Tagen

Sonicker ist eine Voice-Cloning-Webanwendung, die geklonte Sprache aus nur 3 Sekunden Audioeingabe erzeugt. Das Tool wurde von einem Einzelentwickler in 4 Tagen mit Claude Code erstellt.
Technische Umsetzung
Das Kernmodell, das Sonicker antreibt, ist Qwen3-TTS, das der Entwickler als "ein großartiges Modell, aber schwer lokal lauffähig" beschreibt. Um es zugänglich zu machen, bauten sie einen Webdienst, der das Modell ohne lokale Installation ausführt.
Die gesamte Anwendung wurde mit Claude Code geschrieben. Laut dem Entwickler: "Claude Code hat das gesamte Frontend, die API-Integration und die Deployment-Konfiguration übernommen. Ich habe hauptsächlich nur beschrieben, was ich wollte, und die Ausgabe überprüft."
Funktionen und Spezifikationen
- Benötigt nur 3 Sekunden Audio für das Voice-Cloning
- Keine Registrierung erforderlich, um es auszuprobieren
- Kostenlose Credits inklusive
- Unterstützt mehrere Sprachen: Englisch, Spanisch, Japanisch, Koreanisch, Chinesisch, Französisch und mehr
- Speziell aufgelistete Unterstützung für 10 Hauptsprachen: Englisch, Chinesisch, Japanisch, Koreanisch, Deutsch, Französisch, Russisch, Portugiesisch, Spanisch und Italienisch
- Workflow: Sprachmuster hochladen + Text eingeben → erzeugt geklonte Sprache
- Der Entwickler merkt an: "Ehrlich gesagt, die Qualität ist überraschend gut."
Technischer Stack
- Kernmodell: Qwen3-TTS (verfügbar auf GitHub)
- Erstellt mit: Opus 4.6, Next.js, Cloudflare Workers
- Deployment: Webdienst-Architektur, um Probleme mit lokalen Modellgewichten zu vermeiden
Ressourcen
- Modell-Repository: https://github.com/QwenLM/Qwen3-TTS
- Web-App: sonicker.com
Der Entwickler sucht Feedback zu potenziellen Anwendungsfällen und fragt: "Ich bin neugierig, welche Anwendungsfälle die Leute hier am nützlichsten finden würden – Content-Erstellung, Synchronisation, Barrierefreiheit?"
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Lokales MCP-Speichersystem mit Konsolidierung für KI-Gespräche
Ein Entwickler hat einen MCP-Server erstellt, der lokalen persistenten Speicher für KI-Clients bereitstellt und dabei Qwen 2.5-7B nutzt, um Gespräche alle 6 Stunden in strukturierte Wissensdokumente zu konsolidieren. Das System läuft vollständig auf Ihrer Hardware mit semantischer Deduplizierung, adaptivem Scoring und FAISS-Vektorsuche.

TUI Studio: Visuelles Terminal-UI-Design-Tool in der Alpha-Phase
TUI Studio ist ein Figma-ähnlicher visueller Editor zum Gestalten von Terminal-Benutzeroberflächen mit Drag-and-Drop-Komponenten, Echtzeit-ANSI-Vorschau und geplantem Export zu sechs Frameworks, darunter Ink, BubbleTea und Textual. Derzeit in der Alpha-Phase mit nicht funktionierenden Exporten, verfügbar für macOS, Windows und Docker.

MCP-Server ermöglicht es Claude, zur Laufzeit benutzerdefinierte Tools zu erstellen und auszuführen
Ein Entwickler hat einen MCP-Server gebaut, bei dem Claude neue Tools erstellen, aktualisieren und ausführen kann, ohne dass eine erneute Bereitstellung erforderlich ist. Das System verwendet fünf Kern-Tools und führt benutzerdefinierten JavaScript/TypeScript-Code in einer Deno-Sandbox mit etwa 50 ms Kaltstart aus.

Lokaler KI-Agent erreicht Sub-Sekunden-STT- und TTS-Latenz mit Open-Source-Servern
Ein Entwickler erreichte ~0,2s STT-Latenz mit Whisper large-v3-turbo in einer hybriden, thread-verwalteten GPU-Architektur und ~250ms TTS-Latenz mit Coqui-TTS, optimiert für synthese mit geringer Latenz. Beide Implementierungen sind vollständig selbst gehostet und quelloffen.