Copycat — 한국어 가창 음성 합성 모델 (가중치)

Copycat 스튜디오용 한국어 Singing Voice Synthesis(SVS) 음향 모델 가중치입니다. mel-GAN refiner 가 포함되어 있습니다. 실행 코드(스튜디오/추론/에디터)는 별도 리포에 있습니다:

코드: https://github.com/poralis9/copycat ← 실행 방법·스튜디오·CLI 는 여기서

포함 파일

파일 설명
best.pt PyTorch 체크포인트 (음향 모델 + refiner, 추론 전용·weights-only)
svs_encoder.onnx / .data (선택) acoustic encoder ONNX
svs_decoder.onnx / .data (선택) acoustic decoder ONNX

보코더는 포함하지 않습니다. NSF-HiFiGAN 보코더 가중치는 최초 실행 시 코드가 choihkk/nsf-hifigan(HuggingFace)에서 자동 다운로드하며, 그 가중치에는 원저작자의 라이선스가 적용됩니다. (ONNX 백엔드용 보코더는 코드 리포의 onnx/export_vocoder.py 로 로컬에서 직접 생성합니다.)

사용법

# 1) 코드 리포 클론
git clone https://github.com/poralis9/copycat
cd copycat
pip install -r requirements.txt

# 2) 이 리포에서 best.pt 다운로드 (같은 폴더에 배치)
huggingface-cli download poralis/copycat best.pt --local-dir .

# 3) 실행
python svs_studio.py

자세한 스튜디오/CLI/ONNX 백엔드 사용법은 코드 리포의 README 를 참고하세요.

데이터 출처 (Attribution)

본 모델은 AI-Hub '다음색 가이드보컬 데이터' (dataSetSn=473, 한국지능정보사회진흥원 NIA 지원 사업)를 활용하여 학습되었습니다. 원본 데이터셋의 저작권은 NIA 및 데이터 구축 수행기관에 있으며, 이 리포에는 원본 데이터가 포함되어 있지 않습니다. 데이터가 필요하면 AI-Hub 에서 별도 승인·다운로드해야 합니다.

License

PolyForm Noncommercial License 1.0.0 — 비상업적 이용만 허용됩니다(LICENSE). 가중치에는 ACCEPTABLE_USE.md 가 추가로 적용됩니다:

  • ❌ 비윤리적 용도 사용 금지
  • ❌ 타인 목소리 무단 사용(동의 없는 보이스클로닝) 금지

위반 시 가중치 이용 권한은 즉시 종료됩니다.

Commercial Use

상업적 이용은 기본 금지입니다. 상업 라이선스 협의(듀얼 라이선스)를 원하시면 subchanhee@gmail.com 으로 문의해 주세요.

© poralis

Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support