待验证50% 置信事实精确时间
5.18.0 中 GGUF 集成新增了对 MoE 的支持,compressed-tensors 的 FP8 kernel 现可在 MPS(torch ≥ 2.15)上运行,并引入了 OpenVINO HF 导出器,补充了 XPU 和 MUSA 平台的 Flash Attention 支持
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/10/4
首次发现
有效期至:2027/1/2
来源
涉及实体
相关事实
待验证标准版GLM 5.3可通过命令ollama launch claude --model glm-5.3:cloud部署,GLM 5.3 Flash通过ollama launch opencode --model glm-5.3-flash:cloud启动66% 相似待验证Colibri V1.1.0新增DeepSeek V4.1 Flash引擎作为第9个引擎,采用FP8稠密+FP4专家,含视觉,552B参数64% 相似待验证Blender自2.80版本起将GLB/glTF列为首选导出格式62% 相似待验证MiMo V2.6 Pro 采用混合专家架构(MoE),Flash 版本同样是 MoE 架构61% 相似待验证ExecuTorch宣布为Muse Glimmer提供端到端支持,使其能够在NVIDIA硬件平台上运行61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/972014API
curl https://kongchang.com/api/v1/knowledge/claims/972014MCP
get_claim(id=972014)