e38861719/Qwen2.5-7B-Instruct-ToolRL-PPO-Cold-Equal-Max Reinforcement Learning • 8B • Updated May 8 • 4
zecanard/Qwopus3.6-35B-A3B-v1-MLX-8bit-int8-affine Image-Text-to-Text • 11B • Updated Jun 12 • 55 • 1