待验证50% 置信事实精确时间
Qwen3-8B Flash的效果与DeepSeek的27B模型差不多,原生上下文为256K,可扩展至1M,官网已提供100万上下文的API接口
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/11
首次发现
有效期至:2026/12/10
来源
涉及实体
相关事实
待验证Qwen3.8 Flash Next 原生上下文窗口为26.2万token,借助YaRN技术可扩展至100万token76% 相似待验证Qwen3.8-Flash-Next的MoE层使用512个专家和Top-10路由,原生上下文窗口达262K,可扩展至1兆Token71% 相似待验证据社区讨论,DeepSeek-V4.1-Flash模型下100万token的上下文窗口占用显存仅约900MB71% 相似待验证Qwen2.5-Max-0902支持100万Token的上下文窗口70% 相似待验证DeepSeek V4 Flash的UD-Q8_K_XL量化版本文件体积为162GB,采用MXFP4+BF16混合精度,达到完全无损70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/906112API
curl https://kongchang.com/api/v1/knowledge/claims/906112MCP
get_claim(id=906112)