待验证70% 置信事实时间未知
主流开源模型在消费级GPU上的推理速度通常在20-80 token/s之间
1
来源数
70%
置信度
长期有效
时效性
2026/5/31
首次发现
来源
GLM 5.1满血旗舰模型实测400 TPS,两分钟从草图到完整应用
bilibiliAI冷科长
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/6847API
curl https://kongchang.com/api/v1/knowledge/claims/6847MCP
get_claim(id=6847)