模型Ling 3.1 flash
Ling-3.1-flash
inclusionAI团队推出的大规模MoE架构语言模型,总参数量约560B,每token激活约25B参数,支持最高100万token上下文窗口
时间轴 (近 90 天)
10月1日
蚂蚁集团推出Ling-3.1-flash,总参数约5600亿,采用MoE架构,每个词元仅激活约250亿参数,上下文上限达100万
待验证50%
9月30日
Ling-3.1-flash采用混合专家(MoE)架构,总参数量约为5600亿(~560B)
待验证50%
9月30日
Ling-3.1-flash每个token仅激活约250亿(~25B)参数
待验证50%
9月30日
inclusionAI团队推出了Ling-3.1-flash模型
待验证50%
9月30日
Ling-3.1-flash的发布策略是先提供两周免费试用,随后开源
待验证50%
9月30日
目前Ling-3.1-flash的benchmark数据仍以社区传播为主,缺乏第三方独立验证
待验证50%
9月30日
Ling-3.1-flash宣称支持最高100万token(1M)的上下文窗口
待验证50%
全部知识事实 (7)
待验证
Ling-3.1-flash宣称支持最高100万token(1M)的上下文窗口
50%待验证Ling-3.1-flash采用混合专家(MoE)架构,总参数量约为5600亿(~560B)
50%待验证Ling-3.1-flash每个token仅激活约250亿(~25B)参数
50%待验证Ling-3.1-flash的发布策略是先提供两周免费试用,随后开源
50%待验证目前Ling-3.1-flash的benchmark数据仍以社区传播为主,缺乏第三方独立验证
50%待验证蚂蚁集团推出Ling-3.1-flash,总参数约5600亿,采用MoE架构,每个词元仅激活约250亿参数,上下文上限达100万
50%待验证inclusionAI团队推出了Ling-3.1-flash模型
50%