bobbydeveloper2014 commited on
Commit
602aab5
·
verified ·
1 Parent(s): 5639513

Upload int8 quantized model (manual quantize)

Browse files
Files changed (2) hide show
  1. config.json +1 -1
  2. pytorch_model.bin +2 -2
config.json CHANGED
@@ -5,7 +5,7 @@
5
  "attention_bias": false,
6
  "attention_dropout": 0.0,
7
  "bos_token_id": 32013,
8
- "dtype": "bfloat16",
9
  "eos_token_id": 32021,
10
  "head_dim": 128,
11
  "hidden_act": "silu",
 
5
  "attention_bias": false,
6
  "attention_dropout": 0.0,
7
  "bos_token_id": 32013,
8
+ "dtype": "float16",
9
  "eos_token_id": 32021,
10
  "head_dim": 128,
11
  "hidden_act": "silu",
pytorch_model.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:5b5f94f3913b4b8fc7ef2e032dec2e37d98f52f8d08b66abd04f578e0760f0e0
3
- size 6887114471
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:36aa097f79ff14fce3d0fd7dce2512e9cab8bcdb4bf1016733e4cf9c74cd27e6
3
+ size 6740611183