afvanluenen commited on
Commit
bbe39b8
·
verified ·
1 Parent(s): bcf9417

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +6 -0
README.md CHANGED
@@ -33,6 +33,7 @@ TODO: get model architecture like on the model card of the previous model
33
 
34
  Full architecture:
35
 
 
36
  [
37
  {
38
  "idx": 0,
@@ -47,9 +48,11 @@ Full architecture:
47
  "type": "sentence_transformers.sentence_transformer.modules.pooling.Pooling"
48
  }
49
  ]
 
50
 
51
  Parameters used:
52
 
 
53
  {
54
  "architectures": [
55
  "BertForMaskedLM"
@@ -74,9 +77,11 @@ Parameters used:
74
  "use_cache": true,
75
  "vocab_size": 6161
76
  }
 
77
 
78
  Preraining parameters used:
79
 
 
80
  {
81
  "epochs"=19,
82
  "eval_steps"=10000,
@@ -86,6 +91,7 @@ Preraining parameters used:
86
  "bf16"=True,
87
  "tf32"=True
88
  }
 
89
 
90
  Note that during pretraining, the --mlm-prob parameter has been set to 0.4, in accordance to [paper](INSERT LINK)
91
 
 
33
 
34
  Full architecture:
35
 
36
+ ```
37
  [
38
  {
39
  "idx": 0,
 
48
  "type": "sentence_transformers.sentence_transformer.modules.pooling.Pooling"
49
  }
50
  ]
51
+ ```
52
 
53
  Parameters used:
54
 
55
+ ```
56
  {
57
  "architectures": [
58
  "BertForMaskedLM"
 
77
  "use_cache": true,
78
  "vocab_size": 6161
79
  }
80
+ ```
81
 
82
  Preraining parameters used:
83
 
84
+ ```
85
  {
86
  "epochs"=19,
87
  "eval_steps"=10000,
 
91
  "bf16"=True,
92
  "tf32"=True
93
  }
94
+ ```
95
 
96
  Note that during pretraining, the --mlm-prob parameter has been set to 0.4, in accordance to [paper](INSERT LINK)
97