待验证50% 置信事实精确时间
主流开源多模态模型上下文长度通常在4K到32K之间,LLaVA-1.5为4096 token,Qwen-VL为8192 token,InternVL2扩展到32K
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/10
首次发现
有效期至:2026/12/9
来源
涉及实体
相关事实
待验证早期LLaMA-2仅支持4K token上下文,而DeepSeek-V3、Qwen2.5等新一代模型已将上下文扩展至128K甚至更长78% 相似待验证Qwen3.6 27B支持262K上下文长度,34B 80层版本保持相同的上下文长度不变72% 相似待验证Qwen3 27B官方模型卡给出了将上下文扩展至100万token的延伸方案70% 相似待验证使用IQ4_XS配合-fa 1 -ctk q8_0 -ctv q8_0对KV缓存进行q8_0量化后,可加载完整32k上下文,常驻内存约16.6GB70% 相似待验证在单张 32GB 显卡、q4_0 量化场景下,上下文长度从更新前的 82,432 token 增至更新后的 199,680 token69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/891434API
curl https://kongchang.com/api/v1/knowledge/claims/891434MCP
get_claim(id=891434)