[控场AI]
模型Ling 3.1 flash

Ling-3.1-flash

inclusionAI团队推出的大规模MoE架构语言模型,总参数量约560B,每token激活约25B参数,支持最高100万token上下文窗口

时间轴 (近 90 天)

10月1日

蚂蚁集团推出Ling-3.1-flash,总参数约5600亿,采用MoE架构,每个词元仅激活约250亿参数,上下文上限达100万

待验证50%
9月30日

Ling-3.1-flash采用混合专家(MoE)架构,总参数量约为5600亿(~560B)

待验证50%
9月30日

Ling-3.1-flash每个token仅激活约250亿(~25B)参数

待验证50%
9月30日

inclusionAI团队推出了Ling-3.1-flash模型

待验证50%
9月30日

Ling-3.1-flash的发布策略是先提供两周免费试用,随后开源

待验证50%
9月30日

目前Ling-3.1-flash的benchmark数据仍以社区传播为主,缺乏第三方独立验证

待验证50%
9月30日

Ling-3.1-flash宣称支持最高100万token(1M)的上下文窗口

待验证50%

全部知识事实 (7)

来源文章