已过期50% 置信基准精确时间
社区实测显示Pro套餐跑DeepSeek V4 Flash一个月能跑约100亿Token,而跑GLM 5.1只剩约16亿Token,差距达6倍
1
来源数
50%
置信度
短期 (~14 天)
时效性
2026/9/17
首次发现
有效期至:2026/10/1(已过期)
来源
涉及实体
相关事实
待验证上一代v4 Flash于7月发布,为2840亿参数,社区可将4-bit专家打包成128GB的gguf版本,用四张二手RTX 3060即可运行77% 相似待验证社区测出V4.1 Flash峰值达400 token/秒的速度,即便上下文拉到100万token速度也变化不大74% 相似待验证DeepSeek Flash模型每秒token输出可达100多73% 相似部分验证在双Spark系统上,DeepSeek V4 Flash(FP8量化)峰值约每秒53个Token72% 相似待验证据社区讨论,DeepSeek-V4.1-Flash模型下100万token的上下文窗口占用显存仅约900MB71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/929249API
curl https://kongchang.com/api/v1/knowledge/claims/929249MCP
get_claim(id=929249)