MiMo V2.6 Pro
小米推出的大语言模型,采用稀疏MoE架构,总参数4720亿、激活参数310亿,主打开源高性价比,支持100万Token上下文窗口
核心事实
时间轴 (近 90 天)
开源大模型MiMo V2.6 Pro采用MIT许可证
MiMo V2.6 Pro集群运行hello测试速度约15 tokens/秒,复杂任务降到约12 tokens/秒
在Craig David歌曲的知识问答中,3-bit量化版比满血Pro版给出更准确答案
MiMo V2.6 Pro集群支持多模态,能识别《帝国时代2》截图并搭建菜单系统
3-bit量化版MiMo V2.6 Pro生成太阳系任务得到黑屏,核爆场景报runtime error
手动找到模型结束思考的灰色节点点选end think标签可强制结束思考循环
博主建议MiMo V2.6 Pro即使是Flash版本也只能用8-bit量化,不应使用更低档位
MiMo V2.6 Pro对量化相当敏感,压缩越狠编码错误越多,体验下降
MiMo V2.6 Pro在SWE基准上成绩达到71.9,高于GLM的66.9
MiMo V2.6 Pro需要约573GB内存才能运行
还有 22 条时间轴事件
全部知识事实 (20)
MiMo V2.6 Pro在Artificial Analysis综合智能榜上拿下46分,与Grok 4.7并列第六、第七位
70%已验证直播页面同时训练MiMo-V2.6 Pro和MiMo-V2.6 Flash两个模型
65%部分验证小米公开了MiMo-V2.6的模型权重、技术报告、强化学习(RL)环境和训练代码
75%部分验证小米官方披露 MiMo-V2.6 的总训练成本仅为350万美元
75%待验证MiMo V2.6 Flash 总参数 310B、激活参数 15B,速度比 Pro 快了接近一倍
70%待验证MiMo V2.6 Pro 总参数 1.02T、激活参数 42B
70%待验证MiMo V2.6 Pro 采用混合专家架构(MoE),Flash 版本同样是 MoE 架构
70%待验证博主建议MiMo V2.6 Pro即使是Flash版本也只能用8-bit量化,不应使用更低档位
50%待验证手动找到模型结束思考的灰色节点点选end think标签可强制结束思考循环
50%待验证3-bit量化版MiMo V2.6 Pro生成太阳系任务得到黑屏,核爆场景报runtime error
50%待验证MiMo V2.6 Pro集群支持多模态,能识别《帝国时代2》截图并搭建菜单系统
50%待验证在Craig David歌曲的知识问答中,3-bit量化版比满血Pro版给出更准确答案
50%待验证MiMo V2.6 Pro集群运行hello测试速度约15 tokens/秒,复杂任务降到约12 tokens/秒
50%待验证开源大模型MiMo V2.6 Pro采用MIT许可证
50%待验证MiMo V2.6 Pro需要约573GB内存才能运行
50%待验证MiMo V2.6 Pro在SWE基准上成绩达到71.9,高于GLM的66.9
50%待验证MiMo V2.6 Pro对量化相当敏感,压缩越狠编码错误越多,体验下降
50%待验证在AI Builder模型能力智力榜上,Claude Opus 5.5 Max以58分登顶,小米MiMo V2.6 Pro以46分列第9,Qwen 3.8 Max以45分列第10
50%待验证在 Artificial Analysis 榜单上 Grok 4.7 得分为 46,与 MiMo V2.6 Pro 持平
50%待验证在 500 字第一人称写作测试中 MiMo V2.6 Pro 表现最出色,超过 Grok 4.7 与 Flash
50%