sbv2-coreml-common / source-model-card.md
AILogDev's picture
Reduce shared BERT size with 8bit blockwise weight storage
eeac9c2 verified
|
Raw History Blame Contribute Delete
2.86 kB
metadata
license: cc-by-sa-4.0
language: ja
tags:
  - coreml
  - style-bert-vits2
base_model: ku-nlp/deberta-v2-large-japanese-char-wwm

SBV2 Core ML 共通モデル・辞書

English

iPhone/Apple Silicon Macで日本語音声を合成するための、共通BERTとOpen JTalk辞書です。 SBV2 Core MLと、別配布の声モデルを合わせて使います。 互換性のある声を追加するとき、この共通モデルを取得し直す必要はありません。

使い方

対応環境はiOS 18以上、macOS 15以上のApple Siliconです。配布ファイルは約1.52 GBです。 初回のCore MLコンパイル用に、追加の空き容量を用意してください。

サンプルアプリの モデル設定 → URLからモデルを取得 で 共通モデル を選び、次のURLを入力します。

https://huggingface.co/AILogDev/sbv2-coreml-common/resolve/main/download.json

Macのターミナルから取得する場合は、Hugging Face CLIを使います。

hf download AILogDev/sbv2-coreml-common --local-dir models/sbv2-coreml-common

取得したフォルダをサンプルの 共通モデル として選ぶと、BERTと辞書が自動認識されます。 SDKへ組み込む場合は、ModelPaths.bertへbert/、ModelPaths.dictionaryへdictionary/を渡します。 .mlpackageの中身を含め、フォルダ全体を取得してください。取得後の音声合成はオフラインで動作します。

サンプルの起動手順 · SDK導入ガイド

内容とライセンス

  • BERT: 京都大学の自然言語処理研究グループによるDeBERTa日本語モデル。原本のコミットは547b0e8b044fba3f9b84d0ab9f990440bd130c8bです。
  • FP32の2つのCore MLモデルへ変換しています。入力長は64/128/256。再学習・量子化は行っていません。
  • BERTのライセンスは CC BY-SA 4.0 です。LICENSE.mdを参照してください。
  • 辞書: Open JTalk 1.11 UTF-8辞書。BSD系の条件が別途適用されます。dictionary/COPYINGを参照してください。

原本と変換方法はprovenance.json、ファイルのSHA-256はchecksums.jsonに記載しています。 非公式の変換物であり、原作者による承認・推奨を示すものではありません。 SDK・サンプル・変換ツールのコードは AGPL-3.0 です。