Instructions to use Fhrozen/tts_prodiff_jp_multispk with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- ESPnet
How to use Fhrozen/tts_prodiff_jp_multispk with ESPnet:
from espnet2.bin.tts_inference import Text2Speech model = Text2Speech.from_pretrained("Fhrozen/tts_prodiff_jp_multispk") speech, *_ = model("text to generate speech from") - Notebooks
- Google Colab
- Kaggle
File size: 309 Bytes
8aedd8b 42e7292 8aedd8b 1aaacd0 8aedd8b 42e7292 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 | ---
tags:
- espnet
- audio
- text-to-speech
language:
- ja
datasets:
- jvs
license: cc-by-4.0
inference: false
---
## TTS model (Japanese) - ProDiff with GST + X-Vector
**No support given.**
### Details
```
num_iters_per_epoch: 250
max_epoch: 600
batch_bins: 6000000
tts_conf:
spk_embed_dim: 192
```
|