[控场AI]
模型

Naive-N0.5-Flash

一个309B参数的MoE开源模型,激活参数约15.5B,原生支持100万token上下文,定位于代码研发和AI研发领域,基于小米MiMo-V2.5进行二次训练

时间轴 (近 90 天)

9月28日

Naive-N0.5-Flash 是一个 309B 参数的 MoE(混合专家)模型,激活参数约 15.5B

待验证50%
9月28日

Naive-N0.5-Flash 原生支持 100 万 token 上下文,且未采用全注意力机制

待验证50%
9月28日

Naive-N0.5-Flash 单并发可优化到约 2000 token/s,多并发场景下可达每秒 50 token 以上

待验证50%
9月28日

Naive-N0.5-Flash 是基于小米的 MiMo-V2.5 模型进行公开训练的

待验证50%
9月28日

官方宣称 Naive-N0.5-Flash 在 SWE-bench 1.1 等测试上仅次于部分头部模型,并称在开源模型中表现领先

待验证50%
9月28日

Naive-N0.5-Flash 的 BF16 权重文件约 618GB,FP8 格式版本权重约 315GB

待验证50%
9月28日

Naive-N0.5-Flash 不支持多模态

待验证50%
9月28日

Naive-N0.5-Flash 在删除前提供了可复现的物理环境和完整工具链,但后续该工具链被删除

待验证50%
9月28日

MoE 模型每次推理时只激活一小部分专家子网络,Naive-N0.5-Flash 实际推理时只有约 5% 的参数在工作

待验证50%
9月28日

UP主坤蒙头认为 Naive-N0.5-Flash 更多是一次概念营销而非真正的技术突破

待验证50%

全部知识事实 (10)

来源文章