Llama-3.2-1B-Instruct GPTQ Quantized Collection GPTQ quantized across W4A16, W8A8, FP8, NVFP4 using llm-compressor. • 4 items • Updated 27 days ago
DeepSeek-MoE-16B-Chat GPTQ Quantized Collection DeepSeek-MoE-16B-Chat quantized with GPTQ via llm-compressor: W8A8, W4A16, FP8, NVFP4. • 4 items • Updated 27 days ago
soyrsoyr/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-MTP Text Generation • 17B • Updated 20 days ago • 396