MiniCPM5-2B-FP8 / generation_config.json
Ttimms's picture
MiniCPM5-2B FP8 (compressed-tensors): quant weights + BF16-vs-FP8 eval card (v1)
a626636 verified
Raw History Blame Contribute Delete
214 Bytes
{
"_from_model_config": true,
"bos_token_id": 0,
"do_sample": true,
"eos_token_id": [
1,
130073
],
"pad_token_id": 1,
"temperature": 1.0,
"top_p": 0.95,
"transformers_version": "5.14.1"
}