-
XiaomiMiMo/MiMo-V2.5-Pro
Text Generation • 1T • Updated • 21.1k • • 749 -
XiaomiMiMo/MiMo-V2.5-Pro-Base
Text Generation • 1T • Updated • 592 • 44 -
XiaomiMiMo/MiMo-V2.5
Text Generation • 311B • Updated • 309k • • 422 -
XiaomiMiMo/MiMo-V2.5-Base
Text Generation • 311B • Updated • 398 • 32
AI & ML interests
None defined yet.
Papers
MOPD: Multi-Teacher On-Policy Distillation for Capability Integration in LLM Post-Training
HySparse: A Hybrid Sparse Attention Architecture with Oracle Token Selection and KV Cache Sharing
-
XiaomiMiMo/MiMo-VL-7B-SFT
Image-Text-to-Text • 8B • Updated • 446 • 56 -
XiaomiMiMo/MiMo-VL-7B-RL
Image-Text-to-Text • 8B • Updated • 1.2k • 170 -
XiaomiMiMo/MiMo-VL-7B-RL-2508
Image-Text-to-Text • 8B • Updated • 1.49k • 95 -
XiaomiMiMo/MiMo-VL-7B-SFT-2508
Image-Text-to-Text • 8B • Updated • 537 • 37
MiMo-V2-Flash Series
-
XiaomiMiMo/MiMo-7B-RL-0530
Text Generation • 8B • Updated • 270 • 46 -
XiaomiMiMo/MiMo-7B-RL
Text Generation • 8B • Updated • 32.5k • 278 -
XiaomiMiMo/MiMo-7B-Base
Text Generation • 8B • Updated • 15.6k • 137 -
XiaomiMiMo/MiMo-7B-SFT
Text Generation • 8B • Updated • 803 • 29
-
XiaomiMiMo/MiMo-V2.5-Pro
Text Generation • 1T • Updated • 21.1k • • 749 -
XiaomiMiMo/MiMo-V2.5-Pro-Base
Text Generation • 1T • Updated • 592 • 44 -
XiaomiMiMo/MiMo-V2.5
Text Generation • 311B • Updated • 309k • • 422 -
XiaomiMiMo/MiMo-V2.5-Base
Text Generation • 311B • Updated • 398 • 32
MiMo-V2-Flash Series
-
XiaomiMiMo/MiMo-VL-7B-SFT
Image-Text-to-Text • 8B • Updated • 446 • 56 -
XiaomiMiMo/MiMo-VL-7B-RL
Image-Text-to-Text • 8B • Updated • 1.2k • 170 -
XiaomiMiMo/MiMo-VL-7B-RL-2508
Image-Text-to-Text • 8B • Updated • 1.49k • 95 -
XiaomiMiMo/MiMo-VL-7B-SFT-2508
Image-Text-to-Text • 8B • Updated • 537 • 37
-
XiaomiMiMo/MiMo-7B-RL-0530
Text Generation • 8B • Updated • 270 • 46 -
XiaomiMiMo/MiMo-7B-RL
Text Generation • 8B • Updated • 32.5k • 278 -
XiaomiMiMo/MiMo-7B-Base
Text Generation • 8B • Updated • 15.6k • 137 -
XiaomiMiMo/MiMo-7B-SFT
Text Generation • 8B • Updated • 803 • 29