-
XiaomiMiMo/MiMo-V2.5-Pro
Text Generation • 1T • Updated • 56.8k • • 723 -
XiaomiMiMo/MiMo-V2.5-Pro-Base
Text Generation • 1T • Updated • 438 • 42 -
XiaomiMiMo/MiMo-V2.5
Text Generation • 311B • Updated • 347k • • 377 -
XiaomiMiMo/MiMo-V2.5-Base
Text Generation • 311B • Updated • 963 • 30
AI & ML interests
None defined yet.
Recent Activity
View all activity
Papers
MOPD: Multi-Teacher On-Policy Distillation for Capability Integration in LLM Post-Training
HySparse: A Hybrid Sparse Attention Architecture with Oracle Token Selection and KV Cache Sharing
-
XiaomiMiMo/MiMo-VL-7B-SFT
Image-Text-to-Text • 8B • Updated • 336 • 55 -
XiaomiMiMo/MiMo-VL-7B-RL
Image-Text-to-Text • 8B • Updated • 2.8k • 169 -
XiaomiMiMo/MiMo-VL-7B-RL-2508
Image-Text-to-Text • 8B • Updated • 1.24k • 92 -
XiaomiMiMo/MiMo-VL-7B-SFT-2508
Image-Text-to-Text • 8B • Updated • 2.77k • 36
-
XiaomiMiMo/MiMo-V2.5-Pro
Text Generation • 1T • Updated • 56.8k • • 723 -
XiaomiMiMo/MiMo-V2.5-Pro-Base
Text Generation • 1T • Updated • 438 • 42 -
XiaomiMiMo/MiMo-V2.5
Text Generation • 311B • Updated • 347k • • 377 -
XiaomiMiMo/MiMo-V2.5-Base
Text Generation • 311B • Updated • 963 • 30
MiMo-V2-Flash Series
-
XiaomiMiMo/MiMo-VL-7B-SFT
Image-Text-to-Text • 8B • Updated • 336 • 55 -
XiaomiMiMo/MiMo-VL-7B-RL
Image-Text-to-Text • 8B • Updated • 2.8k • 169 -
XiaomiMiMo/MiMo-VL-7B-RL-2508
Image-Text-to-Text • 8B • Updated • 1.24k • 92 -
XiaomiMiMo/MiMo-VL-7B-SFT-2508
Image-Text-to-Text • 8B • Updated • 2.77k • 36