File size: 453 Bytes
3b2d368 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 | defaults:
- model: transformer
- size: 1_3b
- training: 1_3b
- dataset: slimpajama_5m
- benchmark: base
- generation: base
- _self_
hydra:
output_subdir: null
run:
dir: .
mode: train
checkpoint_name: auto # By default, sets the name to {model_name}_{size_name}
tokenizer_base: bert-base-uncased # Defaults to GPT2 (50k vocab size)
# tokenizer_base: gpt2 # Defaults to GPT2 (50k vocab size)
seed: 42 |