hf-transformers-bot HF Staff commited on
Commit
0e6c025
·
verified ·
1 Parent(s): 9c9d02f

Update tiny models for ClvpModelForConditionalGeneration

Browse files
added_tokens.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ {
2
+ "<|endoftext|>": 255
3
+ }
config.json ADDED
@@ -0,0 +1,91 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "architectures": [
3
+ "ClvpModelForConditionalGeneration"
4
+ ],
5
+ "decoder_config": {
6
+ "activation_function": "gelu_new",
7
+ "add_cross_attention": false,
8
+ "attention_dropout": 0.1,
9
+ "bos_token_id": 97,
10
+ "decoder_fixing_codes": [
11
+ 83,
12
+ 45,
13
+ 45,
14
+ 248
15
+ ],
16
+ "embd_pdrop": 0.1,
17
+ "eos_token_id": 98,
18
+ "feature_size": 80,
19
+ "hidden_size": 128,
20
+ "initializer_factor": 1.0,
21
+ "initializer_range": 0.02,
22
+ "layer_norm_epsilon": 1e-05,
23
+ "max_position_embeddings": 30,
24
+ "max_text_tokens": 30,
25
+ "model_type": "clvp_decoder",
26
+ "n_inner": null,
27
+ "num_attention_heads": 2,
28
+ "num_hidden_layers": 1,
29
+ "num_mel_attn_blocks": 6,
30
+ "pad_token_id": null,
31
+ "relative_attention_max_distance": 16,
32
+ "relative_attention_num_buckets": 4,
33
+ "resid_pdrop": 0.1,
34
+ "summary_activation": null,
35
+ "summary_first_dropout": 0.1,
36
+ "summary_proj_to_labels": true,
37
+ "summary_type": "cls_index",
38
+ "summary_use_proj": true,
39
+ "use_attention_bias": true,
40
+ "use_cache": true,
41
+ "vocab_size": 50
42
+ },
43
+ "dtype": "float32",
44
+ "initializer_factor": 1.0,
45
+ "logit_scale_init_value": 2.6592,
46
+ "model_type": "clvp",
47
+ "projection_dim": 16,
48
+ "speech_config": {
49
+ "attention_dropout": 0.1,
50
+ "bos_token_id": 49,
51
+ "dropout": 0.1,
52
+ "eos_token_id": 49,
53
+ "hidden_act": "gelu",
54
+ "hidden_size": 128,
55
+ "initializer_factor": 1.0,
56
+ "initializer_range": 0.02,
57
+ "intermediate_size": 32,
58
+ "layer_norm_eps": 1e-05,
59
+ "model_type": "clvp_encoder",
60
+ "num_attention_heads": 4,
61
+ "num_hidden_layers": 2,
62
+ "pad_token_id": null,
63
+ "projection_dim": 16,
64
+ "summary_type": "mean",
65
+ "use_attention_bias": false,
66
+ "use_rotary_embedding": true,
67
+ "vocab_size": 300
68
+ },
69
+ "text_config": {
70
+ "attention_dropout": 0.1,
71
+ "bos_token_id": 1,
72
+ "dropout": 0.1,
73
+ "eos_token_id": 0,
74
+ "hidden_act": "gelu",
75
+ "hidden_size": 128,
76
+ "initializer_factor": 1.0,
77
+ "initializer_range": 0.02,
78
+ "intermediate_size": 32,
79
+ "layer_norm_eps": 1e-05,
80
+ "model_type": "clvp_encoder",
81
+ "num_attention_heads": 4,
82
+ "num_hidden_layers": 2,
83
+ "pad_token_id": null,
84
+ "projection_dim": 16,
85
+ "summary_type": "mean",
86
+ "use_attention_bias": false,
87
+ "use_rotary_embedding": true,
88
+ "vocab_size": 256
89
+ },
90
+ "transformers_version": "5.16.0.dev0"
91
+ }
generation_config.json ADDED
@@ -0,0 +1,8 @@
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "_from_model_config": true,
3
+ "bos_token_id": 1,
4
+ "eos_token_id": 0,
5
+ "output_attentions": false,
6
+ "output_hidden_states": false,
7
+ "transformers_version": "5.16.0.dev0"
8
+ }
merges.txt ADDED
@@ -0,0 +1,214 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ t h
2
+ i n
3
+ th e
4
+ a n
5
+ e r
6
+ o u
7
+ r e
8
+ o n
9
+ a t
10
+ e d
11
+ e n
12
+ t o
13
+ in g
14
+ an d
15
+ i s
16
+ a s
17
+ a l
18
+ o r
19
+ o f
20
+ a r
21
+ i t
22
+ e s
23
+ h e
24
+ s t
25
+ l e
26
+ o m
27
+ s e
28
+ b e
29
+ a d
30
+ o w
31
+ l y
32
+ c h
33
+ w h
34
+ th at
35
+ y ou
36
+ l i
37
+ v e
38
+ a c
39
+ t i
40
+ l d
41
+ m e
42
+ w as
43
+ g h
44
+ i d
45
+ l l
46
+ w i
47
+ en t
48
+ f or
49
+ a y
50
+ r o
51
+ v er
52
+ i c
53
+ h er
54
+ k e
55
+ h is
56
+ n o
57
+ u t
58
+ u n
59
+ i r
60
+ l o
61
+ w e
62
+ r i
63
+ h a
64
+ wi th
65
+ gh t
66
+ ou t
67
+ i m
68
+ i on
69
+ al l
70
+ a b
71
+ on e
72
+ n e
73
+ g e
74
+ ou ld
75
+ t er
76
+ m o
77
+ h ad
78
+ c e
79
+ s he
80
+ g o
81
+ s h
82
+ u r
83
+ a m
84
+ s o
85
+ p e
86
+ m y
87
+ d e
88
+ a re
89
+ b ut
90
+ om e
91
+ f r
92
+ the r
93
+ f e
94
+ s u
95
+ d o
96
+ c on
97
+ t e
98
+ a in
99
+ er e
100
+ p o
101
+ i f
102
+ the y
103
+ u s
104
+ a g
105
+ t r
106
+ n ow
107
+ ou n
108
+ th is
109
+ ha ve
110
+ no t
111
+ s a
112
+ i l
113
+ u p
114
+ th ing
115
+ fr om
116
+ a p
117
+ h im
118
+ ac k
119
+ at ion
120
+ an t
121
+ ou r
122
+ o p
123
+ li ke
124
+ u st
125
+ es s
126
+ b o
127
+ o k
128
+ u l
129
+ in d
130
+ e x
131
+ c om
132
+ s ome
133
+ the re
134
+ er s
135
+ c o
136
+ re s
137
+ m an
138
+ ar d
139
+ p l
140
+ w or
141
+ w ay
142
+ ti on
143
+ f o
144
+ c a
145
+ w ere
146
+ b y
147
+ at e
148
+ p ro
149
+ t ed
150
+ oun d
151
+ ow n
152
+ w ould
153
+ t s
154
+ wh at
155
+ q u
156
+ al ly
157
+ i ght
158
+ c k
159
+ g r
160
+ wh en
161
+ v en
162
+ c an
163
+ ou gh
164
+ in e
165
+ en d
166
+ p er
167
+ ou s
168
+ o d
169
+ id e
170
+ k now
171
+ t y
172
+ ver y
173
+ s i
174
+ a k
175
+ wh o
176
+ ab out
177
+ i ll
178
+ the m
179
+ es t
180
+ re d
181
+ y e
182
+ c ould
183
+ on g
184
+ you r
185
+ the ir
186
+ e m
187
+ j ust
188
+ o ther
189
+ in to
190
+ an y
191
+ wh i
192
+ u m
193
+ t w
194
+ as t
195
+ d er
196
+ d id
197
+ i e
198
+ be en
199
+ ac e
200
+ in k
201
+ it y
202
+ b ack
203
+ t ing
204
+ b r
205
+ mo re
206
+ a ke
207
+ p p
208
+ the n
209
+ s p
210
+ e l
211
+ u se
212
+ b l
213
+ sa id
214
+ o ver
model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d37c63bd5c41294b1c612228d11883e2ed5774cdebbca30c90cbac627b2a6f0a
3
+ size 4215404
preprocessor_config.json ADDED
@@ -0,0 +1,96 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "chunk_length": 30,
3
+ "default_audio_length": 6,
4
+ "feature_extractor_type": "ClvpFeatureExtractor",
5
+ "feature_size": 80,
6
+ "hop_length": 256,
7
+ "mel_norms": [
8
+ -7.0095,
9
+ -6.0832,
10
+ -4.644,
11
+ -3.3562,
12
+ -2.4548,
13
+ -2.0097,
14
+ -1.6036,
15
+ -1.8641,
16
+ -2.3728,
17
+ -2.3455,
18
+ -2.5947,
19
+ -2.6695,
20
+ -2.7129,
21
+ -2.8555,
22
+ -3.0251,
23
+ -3.0889,
24
+ -3.4261,
25
+ -3.6759,
26
+ -4.078,
27
+ -4.4624,
28
+ -4.7812,
29
+ -5.0075,
30
+ -5.1284,
31
+ -5.2717,
32
+ -5.4006,
33
+ -5.4993,
34
+ -5.531,
35
+ -5.5878,
36
+ -5.6726,
37
+ -5.7016,
38
+ -5.7943,
39
+ -5.8831,
40
+ -5.9537,
41
+ -5.9989,
42
+ -6.0305,
43
+ -6.0539,
44
+ -6.0748,
45
+ -6.1163,
46
+ -6.1481,
47
+ -6.2476,
48
+ -6.3195,
49
+ -6.4457,
50
+ -6.5377,
51
+ -6.611,
52
+ -6.6481,
53
+ -6.6671,
54
+ -6.6539,
55
+ -6.6499,
56
+ -6.6794,
57
+ -6.7833,
58
+ -6.9307,
59
+ -7.0818,
60
+ -7.1894,
61
+ -7.2439,
62
+ -7.3168,
63
+ -7.3779,
64
+ -7.4491,
65
+ -7.5233,
66
+ -7.6224,
67
+ -7.7473,
68
+ -7.8994,
69
+ -8.0604,
70
+ -8.2181,
71
+ -8.3998,
72
+ -8.5556,
73
+ -8.7161,
74
+ -8.8481,
75
+ -8.9582,
76
+ -9.0371,
77
+ -9.0867,
78
+ -9.1546,
79
+ -9.2038,
80
+ -9.2334,
81
+ -9.2292,
82
+ -9.2304,
83
+ -9.268,
84
+ -9.3156,
85
+ -9.3716,
86
+ -9.4165,
87
+ -9.4822
88
+ ],
89
+ "n_fft": 1024,
90
+ "n_samples": 661500,
91
+ "nb_max_frames": 2583,
92
+ "padding_side": "right",
93
+ "padding_value": 0.0,
94
+ "return_attention_mask": false,
95
+ "sampling_rate": 22050
96
+ }
tokenizer_config.json ADDED
@@ -0,0 +1,49 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "add_prefix_space": false,
3
+ "added_tokens_decoder": {
4
+ "0": {
5
+ "content": "[STOP]",
6
+ "lstrip": false,
7
+ "normalized": false,
8
+ "rstrip": false,
9
+ "single_word": false,
10
+ "special": false
11
+ },
12
+ "1": {
13
+ "content": "[UNK]",
14
+ "lstrip": false,
15
+ "normalized": false,
16
+ "rstrip": false,
17
+ "single_word": false,
18
+ "special": false
19
+ },
20
+ "2": {
21
+ "content": "[SPACE]",
22
+ "lstrip": false,
23
+ "normalized": false,
24
+ "rstrip": false,
25
+ "single_word": false,
26
+ "special": false
27
+ },
28
+ "255": {
29
+ "content": "<|endoftext|>",
30
+ "lstrip": false,
31
+ "normalized": false,
32
+ "rstrip": false,
33
+ "single_word": false,
34
+ "special": true
35
+ }
36
+ },
37
+ "backend": "custom",
38
+ "bos_token": "<|endoftext|>",
39
+ "clean_up_tokenization_spaces": true,
40
+ "eos_token": "[STOP]",
41
+ "errors": "replace",
42
+ "extra_special_tokens": [],
43
+ "is_local": false,
44
+ "local_files_only": false,
45
+ "model_max_length": 402,
46
+ "pad_token": "[STOP]",
47
+ "tokenizer_class": "ClvpTokenizer",
48
+ "unk_token": "[UNK]"
49
+ }
vocab.json ADDED
@@ -0,0 +1,257 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "!": 3,
3
+ "'": 4,
4
+ "(": 5,
5
+ ")": 6,
6
+ ",": 7,
7
+ "-": 8,
8
+ ".": 9,
9
+ "/": 10,
10
+ ":": 11,
11
+ ";": 12,
12
+ "?": 13,
13
+ "[SPACE]": 2,
14
+ "[STOP]": 0,
15
+ "[UNK]": 1,
16
+ "a": 14,
17
+ "ab": 109,
18
+ "about": 215,
19
+ "ac": 77,
20
+ "ace": 238,
21
+ "ack": 157,
22
+ "ad": 68,
23
+ "ag": 143,
24
+ "ain": 137,
25
+ "ak": 213,
26
+ "ake": 245,
27
+ "al": 56,
28
+ "all": 108,
29
+ "ally": 195,
30
+ "am": 122,
31
+ "an": 43,
32
+ "and": 53,
33
+ "ant": 159,
34
+ "any": 229,
35
+ "ap": 155,
36
+ "ar": 59,
37
+ "ard": 177,
38
+ "are": 127,
39
+ "as": 55,
40
+ "ast": 233,
41
+ "at": 48,
42
+ "ate": 186,
43
+ "ation": 158,
44
+ "ay": 88,
45
+ "b": 15,
46
+ "back": 241,
47
+ "be": 67,
48
+ "been": 237,
49
+ "bl": 251,
50
+ "bo": 165,
51
+ "br": 243,
52
+ "but": 128,
53
+ "by": 185,
54
+ "c": 16,
55
+ "ca": 183,
56
+ "can": 201,
57
+ "ce": 117,
58
+ "ch": 71,
59
+ "ck": 197,
60
+ "co": 174,
61
+ "com": 170,
62
+ "con": 135,
63
+ "could": 221,
64
+ "d": 17,
65
+ "de": 126,
66
+ "der": 234,
67
+ "did": 235,
68
+ "do": 134,
69
+ "e": 18,
70
+ "ed": 49,
71
+ "el": 249,
72
+ "em": 225,
73
+ "en": 50,
74
+ "end": 204,
75
+ "ent": 86,
76
+ "er": 44,
77
+ "ere": 138,
78
+ "ers": 173,
79
+ "es": 61,
80
+ "ess": 164,
81
+ "est": 218,
82
+ "ex": 169,
83
+ "f": 19,
84
+ "fe": 132,
85
+ "fo": 182,
86
+ "for": 87,
87
+ "fr": 130,
88
+ "from": 154,
89
+ "g": 20,
90
+ "ge": 112,
91
+ "get": 254,
92
+ "gh": 82,
93
+ "ght": 104,
94
+ "go": 119,
95
+ "gr": 198,
96
+ "h": 21,
97
+ "ha": 102,
98
+ "had": 116,
99
+ "have": 148,
100
+ "he": 62,
101
+ "her": 92,
102
+ "him": 156,
103
+ "his": 94,
104
+ "i": 22,
105
+ "ic": 91,
106
+ "id": 83,
107
+ "ide": 208,
108
+ "ie": 236,
109
+ "if": 140,
110
+ "ight": 196,
111
+ "il": 151,
112
+ "ill": 216,
113
+ "im": 106,
114
+ "in": 41,
115
+ "ind": 168,
116
+ "ine": 203,
117
+ "ing": 52,
118
+ "ink": 239,
119
+ "into": 228,
120
+ "ion": 107,
121
+ "ir": 98,
122
+ "is": 54,
123
+ "it": 60,
124
+ "ity": 240,
125
+ "j": 23,
126
+ "just": 226,
127
+ "k": 24,
128
+ "ke": 93,
129
+ "know": 209,
130
+ "l": 25,
131
+ "ld": 79,
132
+ "le": 64,
133
+ "li": 75,
134
+ "like": 162,
135
+ "ll": 84,
136
+ "lo": 99,
137
+ "ly": 70,
138
+ "m": 26,
139
+ "man": 176,
140
+ "me": 80,
141
+ "mo": 115,
142
+ "more": 244,
143
+ "my": 125,
144
+ "n": 27,
145
+ "ne": 111,
146
+ "no": 95,
147
+ "not": 149,
148
+ "now": 145,
149
+ "o": 28,
150
+ "od": 207,
151
+ "of": 58,
152
+ "ok": 166,
153
+ "om": 65,
154
+ "ome": 129,
155
+ "on": 47,
156
+ "one": 110,
157
+ "ong": 222,
158
+ "op": 161,
159
+ "or": 57,
160
+ "other": 227,
161
+ "ou": 45,
162
+ "ough": 202,
163
+ "ould": 113,
164
+ "oun": 146,
165
+ "ound": 189,
166
+ "our": 160,
167
+ "ous": 206,
168
+ "out": 105,
169
+ "over": 253,
170
+ "ow": 69,
171
+ "own": 190,
172
+ "p": 29,
173
+ "pe": 124,
174
+ "per": 205,
175
+ "pl": 178,
176
+ "po": 139,
177
+ "pp": 246,
178
+ "pro": 187,
179
+ "q": 30,
180
+ "qu": 194,
181
+ "r": 31,
182
+ "re": 46,
183
+ "red": 219,
184
+ "res": 175,
185
+ "ri": 101,
186
+ "ro": 89,
187
+ "s": 32,
188
+ "sa": 150,
189
+ "said": 252,
190
+ "se": 66,
191
+ "sh": 120,
192
+ "she": 118,
193
+ "si": 212,
194
+ "so": 123,
195
+ "some": 171,
196
+ "sp": 248,
197
+ "st": 63,
198
+ "su": 133,
199
+ "t": 33,
200
+ "te": 136,
201
+ "ted": 188,
202
+ "ter": 114,
203
+ "th": 40,
204
+ "that": 73,
205
+ "the": 42,
206
+ "their": 224,
207
+ "them": 217,
208
+ "then": 247,
209
+ "ther": 131,
210
+ "there": 172,
211
+ "they": 141,
212
+ "thing": 153,
213
+ "this": 147,
214
+ "ti": 78,
215
+ "ting": 242,
216
+ "tion": 181,
217
+ "to": 51,
218
+ "tr": 144,
219
+ "ts": 192,
220
+ "tw": 232,
221
+ "ty": 210,
222
+ "u": 34,
223
+ "ul": 167,
224
+ "um": 231,
225
+ "un": 97,
226
+ "up": 152,
227
+ "ur": 121,
228
+ "us": 142,
229
+ "use": 250,
230
+ "ust": 163,
231
+ "ut": 96,
232
+ "v": 35,
233
+ "ve": 76,
234
+ "ven": 200,
235
+ "ver": 90,
236
+ "very": 211,
237
+ "w": 36,
238
+ "was": 81,
239
+ "way": 180,
240
+ "we": 100,
241
+ "were": 184,
242
+ "wh": 72,
243
+ "what": 193,
244
+ "when": 199,
245
+ "whi": 230,
246
+ "who": 214,
247
+ "wi": 85,
248
+ "with": 103,
249
+ "wor": 179,
250
+ "would": 191,
251
+ "x": 37,
252
+ "y": 38,
253
+ "ye": 220,
254
+ "you": 74,
255
+ "your": 223,
256
+ "z": 39
257
+ }