tkwiecinski/amr-fma-Apertus-8B-Instruct-2509-lora_sft-block_em_legal_bad-e1_blockem_repro-s42

amr-fma training run.

  • Method: lora_sft
  • Base model: swiss-ai/Apertus-8B-Instruct-2509
  • Dataset: legal_incorrect_subtle (slug: block_em_legal_bad)
  • Seed: 42
  • Git commit: 5b0cb11405e4df5273e3c71642979e93ca408ced
  • Exp name: e1_blockem_repro
  • WandB run: mr163p25

Tags

  • phase:P1
  • domain:legal

Checkpoints (branches)

  • step 1 β†’ revision step-00001
  • step 3 β†’ revision step-00003
  • step 5 β†’ revision step-00005
  • step 9 β†’ revision step-00009
  • step 16 β†’ revision step-00016
  • step 29 β†’ revision step-00029
  • step 50 β†’ revision step-00050
  • step 51 β†’ revision step-00051

Pin a specific checkpoint with revision=... in AutoModelForCausalLM.from_pretrained / PeftModel.from_pretrained.

Hyperparameter sections

checkpointing, dataset, evaluation, final_adapter_path, lora, model, optimization, prompt_style, runtime, sdpo, sequence, total_steps

Downloads last month
-
Inference Providers NEW
This model isn't deployed by any Inference Provider. πŸ™‹ Ask for provider support

Model tree for tkwiecinski/amr-fma-Apertus-8B-Instruct-2509-lora_sft-block_em_legal_bad-e1_blockem_repro-s42

Adapter
(120)
this model