Copycat — 한국어 가창 음성 합성 모델 (가중치)
Copycat 스튜디오용 한국어 Singing Voice Synthesis(SVS) 음향 모델 가중치입니다. mel-GAN refiner 가 포함되어 있습니다. 실행 코드(스튜디오/추론/에디터)는 별도 리포에 있습니다:
코드: https://github.com/poralis9/copycat ← 실행 방법·스튜디오·CLI 는 여기서
포함 파일
| 파일 | 설명 |
|---|---|
best.pt |
PyTorch 체크포인트 (음향 모델 + refiner, 추론 전용·weights-only) |
svs_encoder.onnx / .data |
(선택) acoustic encoder ONNX |
svs_decoder.onnx / .data |
(선택) acoustic decoder ONNX |
보코더는 포함하지 않습니다. NSF-HiFiGAN 보코더 가중치는 최초 실행 시 코드가
choihkk/nsf-hifigan(HuggingFace)에서 자동 다운로드하며, 그 가중치에는 원저작자의
라이선스가 적용됩니다. (ONNX 백엔드용 보코더는 코드 리포의 onnx/export_vocoder.py
로 로컬에서 직접 생성합니다.)
사용법
# 1) 코드 리포 클론
git clone https://github.com/poralis9/copycat
cd copycat
pip install -r requirements.txt
# 2) 이 리포에서 best.pt 다운로드 (같은 폴더에 배치)
huggingface-cli download poralis/copycat best.pt --local-dir .
# 3) 실행
python svs_studio.py
자세한 스튜디오/CLI/ONNX 백엔드 사용법은 코드 리포의 README 를 참고하세요.
데이터 출처 (Attribution)
본 모델은 AI-Hub '다음색 가이드보컬 데이터' (dataSetSn=473, 한국지능정보사회진흥원 NIA 지원 사업)를 활용하여 학습되었습니다. 원본 데이터셋의 저작권은 NIA 및 데이터 구축 수행기관에 있으며, 이 리포에는 원본 데이터가 포함되어 있지 않습니다. 데이터가 필요하면 AI-Hub 에서 별도 승인·다운로드해야 합니다.
- 데이터 출처: https://aihub.or.kr/aihubdata/data/view.do?currMenu=115&topMenu=100&dataSetSn=473
- 저작권 구조: NOTICE.md
License
PolyForm Noncommercial License 1.0.0 — 비상업적 이용만 허용됩니다(LICENSE). 가중치에는 ACCEPTABLE_USE.md 가 추가로 적용됩니다:
- ❌ 비윤리적 용도 사용 금지
- ❌ 타인 목소리 무단 사용(동의 없는 보이스클로닝) 금지
위반 시 가중치 이용 권한은 즉시 종료됩니다.
Commercial Use
상업적 이용은 기본 금지입니다. 상업 라이선스 협의(듀얼 라이선스)를 원하시면 subchanhee@gmail.com 으로 문의해 주세요.
© poralis