MMS-TTS Nawdm (naw) — export ONNX (sherpa-onnx)

Ce dépôt contient une version exportée en ONNX du modèle MMS-TTS de Meta pour la langue Nawdm (naw), destinée au déploiement embarqué via sherpa-onnx.

Contenu du dépôt

Fichier Description
model.onnx Modèle TTS exporté au format ONNX
tokens.txt Table de correspondance tokens ↔ IDs

Modèle source

  • Modèle de base : facebook/mms-tts-naw
  • Architecture : VITS
  • Export : ONNX, opset compatible sherpa-onnx

Utilisation avec sherpa-onnx

Python

import sherpa_onnx

tts = sherpa_onnx.OfflineTts(
    sherpa_onnx.OfflineTtsConfig(
        model=sherpa_onnx.OfflineTtsModelConfig(
            vits=sherpa_onnx.OfflineTtsVitsModelConfig(
                model="model.onnx",
                tokens="tokens.txt",
            ),
            num_threads=2,
        )
    )
)

audio = tts.generate("Votre texte en Nawdm ici", sid=0, speed=1.0)

Ligne de commande

sherpa-onnx-offline-tts \
  --vits-model=model.onnx \
  --vits-tokens=tokens.txt \
  --output-filename=output.wav \
  "Votre texte en Nawdm ici"

Langue

  • Code ISO 639-3 : naw
  • Nom : Nawdm
  • Zone géographique : Togo / Afrique de l'Ouest

Limitations

  • Modèle mono-locuteur, sortie audio 16 kHz.
  • Qualité dépendante du corpus d'entraînement original de MMS pour cette langue.
  • Pas d'évaluation formelle (WER/MOS) publiée pour cet export.

Licence

CC-BY-NC 4.0, héritée du modèle MMS original de Meta. Vérifiez la licence du modèle source avant tout usage commercial.

Citation

@article{pratap2023mms,
  title={Scaling Speech Technology to 1,000+ Languages},
  author={Pratap, Vineel and others},
  journal={arXiv},
  year={2023}
}
Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support