
MiMo-V2-Flash是小米公司于2025年12月17日发布的开源推理模型,采用混合专家(MoE)架构,总参数309B(激活参数15B)。该模型由罗福莉主导研发,并于12月24日由小米CEO雷军通过微博公布。 该模型采用5:1混合的滑动窗口注意力(SWA)与全局注意力架构及多层MTP推理加速技术,在27T词元上完成训练,支持256k上下文窗口。 在2026年1月12日版本更新后,其在代码生成基准SWE-Bench中准确率提升至74.2%,在Arena-Hard基准中达90.4分。 其引入路由算法优化技术,支持端侧运行,单卡RTX 3060可实现300毫秒内推理。模型针对小米手机、汽车及智能家居场景进行了优化,支持深度思考与即时响应模式切换,并通过MIT协议开源模型权重及推理代码。 2026年1月26日,该模型API正式启动商业化计费。 小米MiMo大模型团队于2026年2月6日宣布推出HySparse混合稀疏注意力架构,该架构是在MiMo-V2-Flash的Hybrid SWA结构基础上改进,采用"极少的全注意力+稀疏注意力"设计。
想要了解更多“MiMo-V2-Flash”的信息,请点击:MiMo-V2-Flash百科
