Qwen/Qwen3-VL-4B-Thinking-FP8
Image-Text-to-Text • 5B • Updated • 1.08k • 32
None defined yet.
TRACE: Rollout-Guided Quantization-Aware Training for FP4 Reinforcement Learning of MoE Language Models
OmniReasoning: Pushing the Limits of Audio-Visual Joint Reasoning