Verified70% confidenceBenchmarkExact time
在RTX 5070(12GB显存)配置下,本地Qwen3 9B模型的输出速度达到约70-76 token/秒
4
Sources
70%
Confidence
Medium-term (~90 days)
Relevance
8/25/2026
First Seen
Valid until: 11/23/2026
Sources
Related Entities
Related Claims
UnverifiedQwythos-9B在Q8量化版本下Token输出速度达到每秒75个左右76% similarUnverifiedQwen3-0.6B 经 INT4 量化后模型文件仅约 400MB,保留约 95% 基准能力,普通笔记本 CPU 即可实现每秒 10-30 token 生成速度75% similarVerified在RTX 5090上,Muse Glimmer生成速度从每秒75个Token提升到233个Token,提速约3.1倍74% similarUnverified在RTX 5060 Ti 16GB + 64GB内存环境下,Qwen3 27B生成响应式个人网站耗时1小时10分钟,平均每秒生成6.42个Token73% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/798209API
curl https://kongchang.com/api/v1/knowledge/claims/798209MCP
get_claim(id=798209)