2026年9月22日,小米发布并开源全模态模型MiMo-V2.6-Pro及Flash。9月28日,其首次进入Arena.ai Code Arena: WebDev总榜前十、MIT开源权重前三;AutoEval初步得1628分,较上代1475分提升153分。该成绩基于奖励模型自动投票,仍需人类投票验证。

据北京市科委官网、央广网等信息,小米于2026年9月22日正式发布并开源MiMo-V2.6系列,包含MiMo-V2.6-Pro与MiMo-V2.6-Flash,定位为全模态模型。其中,Pro版本采用MIT许可证开源,支持免费商用。
技术规格方面,MiMo-V2.6-Pro采用稀疏MoE架构,总参数为1.02万亿,激活参数420亿,并支持1M上下文。校对信息显示,其RL后训练约6天;Pro版本训练成本约262万美元,Flash版本约85万美元,合计超过347万美元。
定价沿用MiMo-V2.5时期标准:Pro版本输入为3元/百万token、输出为6元/百万token。小米方面称,在同等智能水平下,其价格约为海外模型的1/20至1/60;关键信息摘要还显示,该模型约为0.13美元/任务,并被称为刷新开源性价比纪录。
9月28日,MiMo-V2.6-Pro在Arena.ai的Code Arena: WebDev,即网页开发测试场中首次上榜,进入总榜前十,并在采用MIT许可证的开源权重模型中位列前三。
在早期自动评估AutoEval中,MiMo-V2.6-Pro获得1628分。上一代MiMo-V2.5-Pro此前得分为1475分,本次迭代提升153分。开源模型横向对比中,Qwen3.8-flash-next得分为1636分,领先MiMo-V2.6-Pro约8分,与原始素材所称“约7分”基本吻合;MiMo-V2.6-Pro距榜首KimiK3Max约46分。
需要注意的是,不同来源对部分模型分数存在细微口径差异:AI TNT榜单显示claude-fable-5-high为1627分、hy4-preview为1627分,而原始素材分别表述为与Claude Fable5(High)持平、领先1624分的Hy4-preview。因此,更稳妥的表述是MiMo-V2.6-Pro与Claude Fable5(High)基本持平,具体分数应以Arena.ai官方实时榜单为准。
该成绩目前被标注为“Preliminary(初步)”,基于奖励模型自动投票产生,最终排名将随真实人类投票累积而变化,现阶段不能视为最终定榜结果。
还需区分“首次亮相”与“重返”的表述:MiMo-V2.6-Pro于9月22日发布、9月28日首次上榜;此前在榜的是MiMo-V2.5-Pro。因此,“重返”更适合描述小米MiMo系列,而非V2.6-Pro本身。
发布当天,MiMo-V2.6系列同步上线Ultraspeed超高速模式与Desktop客户端。9月23日,北京市科委官网发文肯定,称其在Artificial Analysis综合智能指数中以46分暂列开源模型第一、国产第一。
9月24日,央广网报道小米18 Pro发布会时称,MiMo已完成语言、多模态、语音全系列布局;小米未来三年在AI领域拟投入不少于600亿元。
应用层面,MiMo-V2.6-Pro已用于小米内部PFAS吸附MOF材料研发,并完成《周期三蕴含混沌》定理的Lean 4形式化验证。这表明小米披露的信息不仅包含跑分,也涉及材料研发与数学定理验证等具体任务。
作者观点:仅就本次发布而言,小米给出的是“开源许可、模型能力、定价和内部应用”组合,而非单一榜单分数。1628分虽然显示出MiMo-V2.6-Pro在网页开发任务上的竞争力,但仍处于自动评估和初步排名阶段,最终可信度需要人类投票与真实使用检验。因此,不宜凭这一个案直接断言开源大模型已经整体重塑Code Arena格局。