소니커: 클로드 코드로 4일 만에 제작된 음성 복제 웹 앱

Sonicker는 단 3초의 오디오 입력만으로 복제된 음성을 생성하는 음성 복제 웹 애플리케이션입니다. 이 도구는 한 명의 개발자가 Claude Code를 사용해 4일 만에 구축했습니다.
기술 구현
Sonicker의 핵심 모델은 Qwen3-TTS로, 개발자는 "훌륭한 모델이지만 로컬에서 실행하기에는 무겁다"고 언급했습니다. 접근성을 높이기 위해 로컬 설치 없이 모델을 실행하는 웹 서비스를 구축했습니다.
전체 애플리케이션은 Claude Code로 작성되었습니다. 개발자에 따르면: "Claude Code가 전체 프론트엔드, API 통합, 배포 구성을 처리했습니다. 저는 주로 원하는 것을 설명하고 출력을 검토하는 역할만 했습니다."
기능 및 사양
- 음성 복제에 3초의 오디오만 필요
- 체험을 위한 회원가입 불필요
- 무료 크레딧 포함
- 다국어 지원: 영어, 스페인어, 일본어, 한국어, 중국어, 프랑스어 등
- 특히 10개 주요 언어 지원 명시: 영어, 중국어, 일본어, 한국어, 독일어, 프랑스어, 러시아어, 포르투갈어, 스페인어, 이탈리아어
- 워크플로: 음성 샘플 업로드 + 텍스트 입력 → 복제된 음성 생성
- 개발자 언급: "솔직히 품질이 놀랍도록 좋습니다."
기술 스택
- 핵심 모델: Qwen3-TTS (GitHub에서 이용 가능)
- 구축 도구: Opus 4.6, Next.js, Cloudflare workers
- 배포: 로컬 모델 가중치 문제를 피하기 위한 웹 서비스 아키텍처
참고 자료
- 모델 저장소: https://github.com/QwenLM/Qwen3-TTS
- 웹 앱: sonicker.com
개발자는 잠재적 사용 사례에 대한 피드백을 구하며 묻습니다: "사람들이 어떤 사용 사례를 가장 유용하게 생각할지 궁금합니다 — 콘텐츠 제작, 더빙, 접근성?"
📖 전체 출처 읽기: r/ClaudeAI
👀 See Also

로컬 AI 에이전트, 오픈소스 서버로 STT 및 TTS 지연 시간 1초 미만 달성
개발자가 하이브리드 스레드 관리 GPU 아키텍처를 사용한 Whisper large-v3-turbo로 ~0.2초 STT 지연 시간을 달성하고, 저지연 합성을 위해 최적화된 Coqui-TTS로 ~250ms TTS 지연 시간을 달성했습니다. 두 구현 모두 완전히 자체 호스팅되며 오픈소스로 공개되었습니다.

자동화된 클로드 코드 파이프라인으로 기능당 토큰 사용량 78k에서 15k로 절감
Claude Code용 오픈소스 파이프라인은 기존 코드의 사전 점검 분석을 포함한 12단계를 자동화하여 기능당 토큰 사용량을 약 78k에서 약 15k로 줄입니다. 세 가지 프로필(yolo, standard, paranoid)을 제공하며 신뢰도 점수를 grep 기반 검증으로 대체합니다.

AI 샌드박스 매니저: 헤드리스 리눅스에서 GPU 패스스루와 컴퓨터 사용이 가능한 LXC 기반 Codex 샌드박스
ai-sandbox-manager는 헤드리스 Linux에서 Codex 에이전트를 위한 오픈소스 LXC 기반 샌드박스입니다. GPU 패스스루, 전체 sudo 액세스, 영구 환경 및 CUA를 통한 컴퓨터 사용을 제공하면서 에이전트를 호스트 OS로부터 격리합니다.

Agentlint: 모든 PR에서 CLAUDE.md 모순과 깨진 포인터를 잡아내는 GitHub 앱
Agentlint은 모든 PR에서 전체 에이전트 규칙 표면(CLAUDE.md, AGENTS.md, skills, hooks)을 감사하고 모순, 끊어진 경로, 지원되지 않는 하네스 기능에 대해 인라인 댓글을 게시하는 GitHub 앱입니다. 퍼블릭 리포지토리에서 무료입니다.