待验证50% 置信事实精确时间
DeepSeek、Qwen、GLM三家都在旗舰之外单独推出高速轻量的Flash版,且Flash版下载量普遍更高
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/10
首次发现
有效期至:2026/12/9
来源
涉及实体
相关事实
待验证Flash版轻量模型的下载量普遍高于旗舰版,反映用户更看重能在本地显卡运行的模型66% 相似部分验证Qwen3 Next Flash的4-bit量化版本(Q4K XL)约111GB65% 相似待验证DeepSeek V4 Flash的UD-Q8_K_XL量化版本文件体积为162GB,采用MXFP4+BF16混合精度,达到完全无损65% 相似待验证Qwen3.8-Flash-Next的1-bit Dynamic GGUF版本可在75GB内存或统一内存上运行,相比原始BF16格式体积缩小79%,保留80%的top-1准确率64% 相似待验证Qwen3.8 Flash Next 原生上下文窗口为26.2万token,借助YaRN技术可扩展至100万token62% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/888672API
curl https://kongchang.com/api/v1/knowledge/claims/888672MCP
get_claim(id=888672)