Expired65% confidenceBenchmarkExact time
Qwen3 27B在DGX Spark上运行能稳定在20~30 tokens/秒
3
Sources
65%
Confidence
Short-term (~14 days)
Relevance
8/22/2026
First Seen
Valid until: 9/5/2026(expired)
Sources
Related Entities
Related Claims
Unverified在24GB显存的显卡上运行Qwen3.6 27B模型,未经优化可达每秒约40个Token的生成速度,优化后可达50-60 Token/s72% similarUnverifiedQwen3.6 35B模型借助MTP技术在oMLX上达到了86.7 tokens/s的生成速度,prompt处理速度为1735 tokens/s69% similarUnverifiedRTX 5090上Qwen3.6 35B-A3B推理速度达220 token/s,显存占用约23GB64% similarUnverified实测中Qwen3 27B在未开启NVLink的4张魔改2080Ti上生成速度约为40多token/秒64% similarUnverifiedQwen3.6 27B支持262K上下文长度,34B 80层版本保持相同的上下文长度不变64% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/787048API
curl https://kongchang.com/api/v1/knowledge/claims/787048MCP
get_claim(id=787048)