[控场AI]
模型Memo V2.6 Pro / MiMo

MiMo V2.6 Pro

小米推出的大语言模型,采用稀疏MoE架构,总参数4720亿、激活参数310亿,主打开源高性价比,支持100万Token上下文窗口

核心事实

时间轴 (近 90 天)

10月1日

开源大模型MiMo V2.6 Pro采用MIT许可证

待验证50%
10月1日

MiMo V2.6 Pro集群运行hello测试速度约15 tokens/秒,复杂任务降到约12 tokens/秒

待验证50%
10月1日

在Craig David歌曲的知识问答中,3-bit量化版比满血Pro版给出更准确答案

待验证50%
10月1日

MiMo V2.6 Pro集群支持多模态,能识别《帝国时代2》截图并搭建菜单系统

待验证50%
10月1日

3-bit量化版MiMo V2.6 Pro生成太阳系任务得到黑屏,核爆场景报runtime error

待验证50%
10月1日

手动找到模型结束思考的灰色节点点选end think标签可强制结束思考循环

待验证50%
10月1日

博主建议MiMo V2.6 Pro即使是Flash版本也只能用8-bit量化,不应使用更低档位

待验证50%
10月1日

MiMo V2.6 Pro对量化相当敏感,压缩越狠编码错误越多,体验下降

待验证50%
10月1日

MiMo V2.6 Pro在SWE基准上成绩达到71.9,高于GLM的66.9

待验证50%
10月1日

MiMo V2.6 Pro需要约573GB内存才能运行

待验证50%

还有 22 条时间轴事件

全部知识事实 (20)

已验证

MiMo V2.6 Pro在Artificial Analysis综合智能榜上拿下46分,与Grok 4.7并列第六、第七位

70%
已验证

直播页面同时训练MiMo-V2.6 Pro和MiMo-V2.6 Flash两个模型

65%
部分验证

小米公开了MiMo-V2.6的模型权重、技术报告、强化学习(RL)环境和训练代码

75%
部分验证

小米官方披露 MiMo-V2.6 的总训练成本仅为350万美元

75%
待验证

MiMo V2.6 Flash 总参数 310B、激活参数 15B,速度比 Pro 快了接近一倍

70%
待验证

MiMo V2.6 Pro 总参数 1.02T、激活参数 42B

70%
待验证

MiMo V2.6 Pro 采用混合专家架构(MoE),Flash 版本同样是 MoE 架构

70%
待验证

博主建议MiMo V2.6 Pro即使是Flash版本也只能用8-bit量化,不应使用更低档位

50%
待验证

手动找到模型结束思考的灰色节点点选end think标签可强制结束思考循环

50%
待验证

3-bit量化版MiMo V2.6 Pro生成太阳系任务得到黑屏,核爆场景报runtime error

50%
待验证

MiMo V2.6 Pro集群支持多模态,能识别《帝国时代2》截图并搭建菜单系统

50%
待验证

在Craig David歌曲的知识问答中,3-bit量化版比满血Pro版给出更准确答案

50%
待验证

MiMo V2.6 Pro集群运行hello测试速度约15 tokens/秒,复杂任务降到约12 tokens/秒

50%
待验证

开源大模型MiMo V2.6 Pro采用MIT许可证

50%
待验证

MiMo V2.6 Pro需要约573GB内存才能运行

50%
待验证

MiMo V2.6 Pro在SWE基准上成绩达到71.9,高于GLM的66.9

50%
待验证

MiMo V2.6 Pro对量化相当敏感,压缩越狠编码错误越多,体验下降

50%
待验证

在AI Builder模型能力智力榜上,Claude Opus 5.5 Max以58分登顶,小米MiMo V2.6 Pro以46分列第9,Qwen 3.8 Max以45分列第10

50%
待验证

在 Artificial Analysis 榜单上 Grok 4.7 得分为 46,与 MiMo V2.6 Pro 持平

50%
待验证

在 500 字第一人称写作测试中 MiMo V2.6 Pro 表现最出色,超过 Grok 4.7 与 Flash

50%

来源文章