MMS-TTS Nawdm (naw) — export ONNX (sherpa-onnx)
Ce dépôt contient une version exportée en ONNX du modèle MMS-TTS de Meta
pour la langue Nawdm (naw), destinée au déploiement
embarqué via sherpa-onnx.
Contenu du dépôt
| Fichier | Description |
|---|---|
model.onnx |
Modèle TTS exporté au format ONNX |
tokens.txt |
Table de correspondance tokens ↔ IDs |
Modèle source
- Modèle de base :
facebook/mms-tts-naw - Architecture : VITS
- Export : ONNX, opset compatible sherpa-onnx
Utilisation avec sherpa-onnx
Python
import sherpa_onnx
tts = sherpa_onnx.OfflineTts(
sherpa_onnx.OfflineTtsConfig(
model=sherpa_onnx.OfflineTtsModelConfig(
vits=sherpa_onnx.OfflineTtsVitsModelConfig(
model="model.onnx",
tokens="tokens.txt",
),
num_threads=2,
)
)
)
audio = tts.generate("Votre texte en Nawdm ici", sid=0, speed=1.0)
Ligne de commande
sherpa-onnx-offline-tts \
--vits-model=model.onnx \
--vits-tokens=tokens.txt \
--output-filename=output.wav \
"Votre texte en Nawdm ici"
Langue
- Code ISO 639-3 :
naw - Nom : Nawdm
- Zone géographique : Togo / Afrique de l'Ouest
Limitations
- Modèle mono-locuteur, sortie audio 16 kHz.
- Qualité dépendante du corpus d'entraînement original de MMS pour cette langue.
- Pas d'évaluation formelle (WER/MOS) publiée pour cet export.
Licence
CC-BY-NC 4.0, héritée du modèle MMS original de Meta. Vérifiez la licence du modèle source avant tout usage commercial.
Citation
@article{pratap2023mms,
title={Scaling Speech Technology to 1,000+ Languages},
author={Pratap, Vineel and others},
journal={arXiv},
year={2023}
}