MiMo-V2.6-Flash-RL

Xiaomi🇨🇳 China
active
Context window1000K tokens

Version History

V2.6-Flash-RLminor

Xiaomi released MiMo-V2.6-Flash-RL, an efficiency-tier checkpoint of the MiMo-V2.6 series featuring native omnimodal input, 1M-token context, and a single mixed RL training run across coding, agent, visual, and cybersecurity domains. It joins the larger MiMo-V2.6-Pro-RL as part of the same model family release.

Coverage

model releaseXiaomi

Xiaomi Releases MiMo-V2.6-Flash-RL, a 309B-Parameter MoE Model with 1M-Token Context and Native Omnimodal Support

Xiaomi's MiMo team released MiMo-V2.6-Flash-RL, an efficiency-tier checkpoint in the MiMo-V2.6 series featuring a 309B-parameter (15B active) Mixture-of-Experts architecture, 1M-token context, and native support for text, image, video, and audio. The model uses a single mixed reinforcement learning run across coding, agentic, visual, and cybersecurity tasks rather than domain-specific training.

3 min read