Unverified50% confidenceFactExact time
Qwen3-8B Flash的效果与DeepSeek的27B模型差不多,原生上下文为256K,可扩展至1M,官网已提供100万上下文的API接口
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
9/11/2026
First Seen
Valid until: 12/10/2026
Sources
Related Entities
Related Claims
UnverifiedQwen3.8 Flash Next 原生上下文窗口为26.2万token,借助YaRN技术可扩展至100万token76% similarUnverifiedQwen3.8-Flash-Next的MoE层使用512个专家和Top-10路由,原生上下文窗口达262K,可扩展至1兆Token71% similarUnverified据社区讨论,DeepSeek-V4.1-Flash模型下100万token的上下文窗口占用显存仅约900MB71% similarUnverifiedQwen2.5-Max-0902支持100万Token的上下文窗口70% similarUnverifiedDeepSeek V4 Flash的UD-Q8_K_XL量化版本文件体积为162GB,采用MXFP4+BF16混合精度,达到完全无损70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/906112API
curl https://kongchang.com/api/v1/knowledge/claims/906112MCP
get_claim(id=906112)