Speech-to-text quantized models - Qwen2.5 Omni 7B and Whisper large v3 chieunq/Qwen2.5-Omni-7B-RTN-4bit 9B • Updated Apr 24 • 7 • 1 chieunq/Qwen2.5-Omni-7B-GPTQ-W4A16-en 3B • Updated Apr 24 • 7 chieunq/Qwen2.5-Omni-7B-GPTQ-W4A16-vi 3B • Updated Apr 24 • 4 chieunq/Qwen2.5-Omni-7B-AWQ-vi 3B • Updated Apr 24 • 8
Qwen3 quantized variants All my Qwen3 quantized builds (AWQ, GPTQ, GPTQv2, RTN, etc.) grouped by size. chieunq/Qwen3-4B-GPTQ-W8A8_gsm8k2048 4B • Updated Oct 28, 2025 • 8 chieunq/Qwen3-4B-W4A16-all_gsm8k2048 3B • Updated Oct 28, 2025 • 11 chieunq/Qwen3-4B-gptq-v2-4bit-ultrachat_200k2048 4B • Updated Oct 28, 2025 • 7 chieunq/Qwen3-4B-GPTQ-W4A16_gsm8k2048 4B • Updated Oct 28, 2025 • 9
Speech-to-text quantized models - Qwen2.5 Omni 7B and Whisper large v3 chieunq/Qwen2.5-Omni-7B-RTN-4bit 9B • Updated Apr 24 • 7 • 1 chieunq/Qwen2.5-Omni-7B-GPTQ-W4A16-en 3B • Updated Apr 24 • 7 chieunq/Qwen2.5-Omni-7B-GPTQ-W4A16-vi 3B • Updated Apr 24 • 4 chieunq/Qwen2.5-Omni-7B-AWQ-vi 3B • Updated Apr 24 • 8
Qwen3 quantized variants All my Qwen3 quantized builds (AWQ, GPTQ, GPTQv2, RTN, etc.) grouped by size. chieunq/Qwen3-4B-GPTQ-W8A8_gsm8k2048 4B • Updated Oct 28, 2025 • 8 chieunq/Qwen3-4B-W4A16-all_gsm8k2048 3B • Updated Oct 28, 2025 • 11 chieunq/Qwen3-4B-gptq-v2-4bit-ultrachat_200k2048 4B • Updated Oct 28, 2025 • 7 chieunq/Qwen3-4B-GPTQ-W4A16_gsm8k2048 4B • Updated Oct 28, 2025 • 9