Unverified50% confidenceFactExact time
目前只有vLLM能在SM120显卡上跑通千问3.8 Flash Next的完整方案,SGLang暂不支持会在预热阶段崩溃,llama.cpp仍在优化合并请求中
1
Sources
50%
Confidence
Short-term (~14 days)
Relevance
9/2/2026
First Seen
Valid until: 9/16/2026
Sources
Related Entities
Related Claims
UnverifiedvLLM官方推荐的部署方式不支持2080Ti这类图灵架构显卡运行FP8模型67% similarUnverified千问3.8 Flash Next是一款采用下一代千问4架构的Flash模型,开源当天放出了完整权重67% similarUnverified本次实测在8卡H20-141G环境中通过GPUStack部署DeepSeek-V4-Flash(DSpark版本)63% similarUnverifiedGTX 10系列显卡和P40(架构代号sm_61)早已被排除在llama.cpp的fp16快速路径之外,但P100(架构代号sm_60)没有被排除62% similarUnverified追求极致帧率稳定选骁龙8 Gen3/8至尊版机型,天玑9300+虽跑分接近但部分游戏适配和帧率稳定性略逊,联发科平台GPU驱动更新也相对滞后62% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/843532API
curl https://kongchang.com/api/v1/knowledge/claims/843532MCP
get_claim(id=843532)