egms-qa-encoder / training_args.json
risenyard's picture
Complete the public pretraining recipe
5c2ef80 verified
Raw History Blame Contribute Delete
1.23 kB
{
"schema_version": "egms-qa-encoder-training-1.0",
"data": {
"model_input_steps": 294,
"tile_size_m": 7000.0,
"minimum_points_per_tile": 200,
"maximum_points_per_tile": 4096,
"split_seed": 1729
},
"masking": {
"strategy": "synchronized_block",
"train_ratio": 0.3,
"evaluation_ratio": 0.3,
"schedule": "fixed"
},
"point_sampling": {
"method": "residual_weighted",
"residual_sampling_alpha": 0.75
},
"loss": {
"residual_loss_weight": 1.0,
"residual_consistency_weight": 0.1
},
"optimization": {
"optimizer": "AdamW",
"maximum_steps": 150000,
"tiles_per_batch": 8,
"learning_rate": 0.0004,
"minimum_learning_rate": 0.00003,
"residual_head_learning_rate": 0.0001,
"scheduler": "cosine",
"scheduler_total_steps": 150000,
"warmup_steps": 1000,
"weight_decay": 0.01,
"precision": "bf16",
"seed": 42
},
"validation": {
"batches": 16,
"interval_steps": 1000,
"seed": 1729
},
"checkpointing": {
"interval_steps": 5000,
"log_interval_steps": 200,
"rolling_window_steps": 1000
},
"checkpoint_selection": {
"selected_step": 147000,
"best_validation_loss": 0.592400277150065
}
}