待验证50% 置信发布精确时间
vLLM v0.27.1 版本新增了对量化 DSpark Markov heads 的支持,对应 PR #50424
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/11
首次发现
有效期至:2026/12/10
来源
涉及实体
相关事实
待验证DSpark 将马尔可夫头(Markov Head)设为默认核心架构,参数量通常不超过原模型的0.1%64% 相似待验证vLLM v0.28.0rc2引入了名为DFlash2的投机解码新特性,该特性结合了局部卷积与候选选择器两大技术组件(PR #52816)63% 相似待验证2016年随AVX-512推出的VPCLMULQDQ允许在512位向量寄存器上同时处理4组操作数62% 相似待验证vLLM v0.27.0 新增对 K-EXAONE-2.0-750B-A37B 大规模 MoE 模型的支持60% 相似待验证vLLM v0.27.0 引入简化版容错框架,专为 DP+EP 外部负载均衡器部署场景设计,并提供弹性 EP 扩展的异步准备能力59% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/898505API
curl https://kongchang.com/api/v1/knowledge/claims/898505MCP
get_claim(id=898505)