MiMo V2.6 Pro
小米推出的大语言模型,采用稀疏MoE架构,总参数4720亿、激活参数310亿,主打开源高性价比,支持100万Token上下文窗口
Core Facts
Timeline (last 90 days)
开源大模型MiMo V2.6 Pro采用MIT许可证
MiMo V2.6 Pro集群运行hello测试速度约15 tokens/秒,复杂任务降到约12 tokens/秒
在Craig David歌曲的知识问答中,3-bit量化版比满血Pro版给出更准确答案
MiMo V2.6 Pro集群支持多模态,能识别《帝国时代2》截图并搭建菜单系统
3-bit量化版MiMo V2.6 Pro生成太阳系任务得到黑屏,核爆场景报runtime error
手动找到模型结束思考的灰色节点点选end think标签可强制结束思考循环
博主建议MiMo V2.6 Pro即使是Flash版本也只能用8-bit量化,不应使用更低档位
MiMo V2.6 Pro对量化相当敏感,压缩越狠编码错误越多,体验下降
MiMo V2.6 Pro在SWE基准上成绩达到71.9,高于GLM的66.9
MiMo V2.6 Pro需要约573GB内存才能运行
22 more timeline events
All Facts (20)
小米官方披露 MiMo-V2.6 的总训练成本仅为350万美元
80%Verified直播页面同时训练MiMo-V2.6 Pro和MiMo-V2.6 Flash两个模型
65%Partially Verified小米公开了MiMo-V2.6的模型权重、技术报告、强化学习(RL)环境和训练代码
75%UnverifiedMiMo V2.6 Flash 总参数 310B、激活参数 15B,速度比 Pro 快了接近一倍
70%UnverifiedMiMo V2.6 Pro 采用混合专家架构(MoE),Flash 版本同样是 MoE 架构
70%UnverifiedMiMo V2.6 Pro 总参数 1.02T、激活参数 42B
70%UnverifiedMiMo V2.6 Pro集群运行hello测试速度约15 tokens/秒,复杂任务降到约12 tokens/秒
50%Unverified博主建议MiMo V2.6 Pro即使是Flash版本也只能用8-bit量化,不应使用更低档位
50%Unverified手动找到模型结束思考的灰色节点点选end think标签可强制结束思考循环
50%Unverified3-bit量化版MiMo V2.6 Pro生成太阳系任务得到黑屏,核爆场景报runtime error
50%UnverifiedMiMo V2.6 Pro集群支持多模态,能识别《帝国时代2》截图并搭建菜单系统
50%Unverified在Craig David歌曲的知识问答中,3-bit量化版比满血Pro版给出更准确答案
50%Unverified开源大模型MiMo V2.6 Pro采用MIT许可证
50%UnverifiedMiMo V2.6 Pro需要约573GB内存才能运行
50%UnverifiedMiMo V2.6 Pro在SWE基准上成绩达到71.9,高于GLM的66.9
50%UnverifiedMiMo V2.6 Pro对量化相当敏感,压缩越狠编码错误越多,体验下降
50%Unverified在AI Builder模型能力智力榜上,Claude Opus 5.5 Max以58分登顶,小米MiMo V2.6 Pro以46分列第9,Qwen 3.8 Max以45分列第10
50%Unverified在 3D 折纸推理任务中 Grok 4.7 明显优于 MiMo V2.6 Pro
50%Unverified在 500 字第一人称写作测试中 MiMo V2.6 Pro 表现最出色,超过 Grok 4.7 与 Flash
50%UnverifiedMiMo V2.6 Pro的总参数约为Kimi K3的一半,但激活参数处于同一量级
50%