INT8/float32を並べて選べる配置と取得方法に整理
#1
by AILogDev - opened
変更内容
- INT8と元のFP32を、それぞれ独立した共通モデルとして取得できる配置にします。
- トップのモデルカードに、容量・準備時間・音質の違いと、各版のファイル一覧・取得URLをまとめます。
- サンプルアプリのINT8/FP32選択欄、取得URLの自動設定、取得済みフォルダの切り替えに合わせて案内します。
- 各版にBERT・辞書・ライセンス・取得用マニフェストを揃えます。声モデルは両版で共用できます。
- 既存の固定取得URLも引き続き利用できます。
モデルの配置
| フォルダ | 共通BERT・辞書の容量 | 選ぶ目安 |
|---|---|---|
int8/ |
約503 MB | ファイル容量を抑えたい |
float32/ |
約1.52 GB | 重み量子化による数値差を避けたい、準備時間を短くしたい |
INT8はBERTの重みを8bitで保存し、演算・入出力はFP32を維持します。
抑揚や音声の長さに差が生じる場合があります。声モデルの重みと辞書は共通です。
CLIで取得する場合は、--include "int8/*"または--include "float32/*"で片方だけを取得します。
SDKには選んだ版のbert/とdictionary/、別の声モデルフォルダを指定します。
AILogDev changed pull request title from docs: INT8版と元のFP32版の選び方・取得先を明記 to INT8/float32を並べて選べる配置と取得方法に整理
AILogDev changed pull request status to merged