待验证50% 置信事实精确时间
Qwen3.8-Max-0902采用2.4T参数量的混合专家架构(MoE),支持128K上下文长度
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/6
首次发现
有效期至:2026/12/5
来源
涉及实体
相关事实
待验证早期LLaMA-2仅支持4K token上下文,而DeepSeek-V3、Qwen2.5等新一代模型已将上下文扩展至128K甚至更长71% 相似待验证Qwen3.6 27B支持262K上下文长度,34B 80层版本保持相同的上下文长度不变71% 相似待验证3B~4B级别模型如Qwen2.5 3B或Llama 3.2 3B在Q4量化下仅需2~2.5GB显存71% 相似待验证16G显存部署Qwen3 27B只能选到Q3_K_XL的GGUF量化版本,这是16G显存能容纳的精度上限71% 相似待验证运行 Qwen3 对话模型时,8G 显存可选 1.7B/6B 参数版本,12G/16G/24G 显存可选更大参数版本70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/863360API
curl https://kongchang.com/api/v1/knowledge/claims/863360MCP
get_claim(id=863360)