待验证50% 置信基准精确时间
Ling 3.0 Tiny 每处理一个token的算术运算量约为8B稠密模型的六分之一
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/10
首次发现
有效期至:2026/11/8
来源
相关事实
待验证蚂蚁集团实验室发布了 Ling 3.0 Tiny 模型,总参数7.9B,每token激活约1.3B72% 相似待验证4-bit量化只能表示16个离散值,1-bit只有2个,三元量化(-1/0/+1)只有3个可能值64% 相似待验证在4-bit量化下,纯参数理论最小占用为:7B约3.26GiB,13B约6.05GiB,32B约14.90GiB,70B约32.60GiB62% 相似待验证Ling-3.0-flash 采用混合专家(MoE)架构,激活比例仅约4%(124B总参数中激活约5.1B)62% 相似待验证Nex N2 Mini每次推理调用约使用8.6%的参数(3B/35B)61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/723989API
curl https://kongchang.com/api/v1/knowledge/claims/723989MCP
get_claim(id=723989)