inference-optimization/Qwen3-8B-speculator.dflash.swa.dpace.fullvocab-qwen235b-instruct-bs16-ckpt0 2B • Updated 9 days ago • 23 • 1
inference-optimization/Qwen3-VL-1.0B-A0.4B-Instruct Image-Text-to-Text • 1B • Updated 10 days ago • 269 • 1
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16.adamw-g7-ckpt9 2B • Updated 10 days ago • 17
inference-optimization/Qwen3-8B-DFlash-b16-fullattn-fulldataset-rerun-clean-muon1e3-ckpt1 2B • Updated 10 days ago • 28
inference-optimization/Qwen3-8B-DFlash-b16-fullattn-fulldataset-rerun-clean-muon1e3-ckpt0 2B • Updated 11 days ago • 14
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16.adamw-g7-ckpt8 2B • Updated 11 days ago • 20
inference-optimization/Qwen3-8B-DFlash-b16-fullattn-fulldataset-rerun-clean-muon1e3-ckpt0-halfepoch1 2B • Updated 11 days ago • 3
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16.adamw-g7-ckpt7 2B • Updated 11 days ago • 19
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16.adamw-g7-ckpt6 2B • Updated 12 days ago • 22
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16.adamw-g7-ckpt5 2B • Updated 14 days ago • 62
inference-optimization/Qwen3-8B-speculator.dflash.fullattn-qwen235b-instruct-bs16-ckpt2 2B • Updated 20 days ago • 35
inference-optimization/Llama-3.1-8B-Instruct-NVFP4-GPTQ-BlockSize16 5B • Updated 20 days ago • 12 • 1