내 목소리 실험실

처음 한 번만
1. ZIP을 모두 압축 해제합니다.
2. Python 3.11과 Python Launcher가 없다면 먼저 설치합니다.
3. 1-install.cmd를 더블클릭하고 READY를 기다립니다. 설치/모델 준비에 인터넷이 필요합니다.
4. 2-start.cmd를 더블클릭하면 브라우저에 한글 화면이 열립니다.

다음부터는 2-start.cmd만 실행하면 됩니다. 작업 중에는 함께 열린 검은 창을 닫지 마세요.
이미 열어 둔 실행 창이 있으면 같은 창을 사용하세요. 종료할 때는 실행 창에서 Ctrl+C를 누릅니다.

한 문장 만들어 보기
- 본인이 녹음한 깨끗한 M4A 또는 WAV를 넣습니다. 처음에는 10초 안팎으로 시작하세요.
- 왼쪽에는 녹음에서 실제로 읽은 말을 그대로 적습니다.
- 오른쪽에는 새로 읽힐 문장을 적습니다.
- 본인 녹음 확인에 체크하고 '내 목소리로 읽기'를 누릅니다.
- 완성되면 재생하고 내려받기 버튼을 누릅니다. 내려받은 WAV도 다시 열어보세요.
- 다음 문장은 오른쪽만 바꾸면 됩니다. 기존 결과는 덮어쓰지 않습니다.

참조 1~30초, 원고 100자, 생성 10초는 이 예제의 짧은 체험 범위입니다.
모델 전체의 최대 길이라는 뜻이 아닙니다. 긴 원고는 문장별로 나눠 보세요.
별도 학습, GPU 설정, 배속, 자동 음성 자르기는 하지 않습니다.
설치 이후 음성 합성은 로컬 CPU에서 실행합니다. 유료 API나 외부 음성 서버를 쓰지 않습니다.
PC의 전력·시간·저장 공간은 사용합니다. 모델만 약 2.5GB이며 실행 환경 공간도 필요합니다.
개인 녹음과 전사를 공개 저장소나 외부 데모에 올리지 마세요.
이 ZIP에는 사용자 녹음, 생성 음성, 참조 전사, 계정, 모델 파일이 포함되지 않습니다.
음성·전사·실행 기록은 output 폴더에 작업별로 새로 저장됩니다.
화면은 이 글의 한국어 실행 예제이며, 음성 합성 엔진은 Qwen3-TTS 0.6B Base입니다.

실행이 안 될 때
- Python을 찾지 못하면 Python 3.11과 Launcher 설치를 확인하세요.
- 설치가 끝나지 않았으면 1-install.cmd의 마지막 오류를 확인하세요.
- 파일을 못 읽으면 M4A/WAV 형식과 길이를 확인하세요.
- 긴 음성 오류가 나면 새 문장을 더 짧게 바꿔 보세요.
- 출력 파일과 output 폴더의 generation.log는 남으므로 오류 확인에 쓸 수 있습니다.
- 공개 서비스로 운영하는 프로그램이 아닙니다. 내 PC의 127.0.0.1에만 연결합니다.

공식 모델: Qwen/Qwen3-TTS-12Hz-0.6B-Base
고정 revision: 5d83992436eae1d760afd27aff78a71d676296fc
공식 설명: https://github.com/QwenLM/Qwen3-TTS
모델 카드: https://huggingface.co/Qwen/Qwen3-TTS-12Hz-0.6B-Base
Python 설치: https://www.python.org/downloads/release/python-3119/
