File size: 453 Bytes
3b2d368
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
defaults:
  - model: transformer
  - size: 1_3b
  - training: 1_3b
  - dataset: slimpajama_5m
  - benchmark: base
  - generation: base
  - _self_

hydra:
  output_subdir: null
  run:
    dir: .

mode: train
checkpoint_name: auto     # By default, sets the name to {model_name}_{size_name}
# tokenizer_base: bert-base-uncased      # Defaults to GPT2 (50k vocab size)
tokenizer_base: gpt2     # Defaults to GPT2 (50k vocab size)
seed: 42