待验证50% 置信基准精确时间
在配备6核锐龙和64GB内存的RTX 5070上,Strata短对话约90 Token/秒,12.8万Token上下文约67 Token/秒,读取提示词约1300 Token/秒
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/10/5
首次发现
有效期至:2027/1/3
来源
涉及实体
相关事实
已验证在RTX 5070(12GB显存)配置下,本地Qwen3 9B模型的输出速度达到约70-76 token/秒71% 相似待验证旧款RTX 3090因24GB显存能容纳更多专家,预估运行Strata性能反而达100到140 Token/秒,说明此工作负载下显存容量胜过纯浮点算力71% 相似待验证在RTX 5060 Ti 16GB + 64GB内存环境下,Qwen3 27B生成响应式个人网站耗时1小时10分钟,平均每秒生成6.42个Token70% 相似待验证提示处理速度上RTX 4090约3000 tokens/s,M5 Max约800 tokens/s,英伟达在长文档/代码库输入场景优势明显70% 相似已验证9600波特率下UART每秒可传输约960个字节(每字节需10个比特:1起始位+8数据位+1停止位)70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/978620API
curl https://kongchang.com/api/v1/knowledge/claims/978620MCP
get_claim(id=978620)