待验证50% 置信事实精确时间
传统大模型的输出速度通常在每秒50-150个Token之间,高性能模型如Claude、GPT-4o优化后可达每秒200-400个Token
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/8
首次发现
有效期至:2026/12/7
来源
涉及实体
相关事实
待验证转速(RPM)在1800-3200区间即可覆盖绝大多数需求,超过3200RPM的高转速反而会因单次冲击时间过短降低渗透感,营销标称的4000+RPM实际体感提升有限68% 相似待验证在PSP上运行90M参数模型的实测推理速度约为每秒0.5至0.6个token,生成一条完整回复需要1到3分钟68% 相似待验证ChatGPT标准模式的输出速度通常在50-100 Token/秒左右67% 相似待验证Claude or GPT-4 may need 30 seconds or even longer when handling complex multi-file refactoring tasks66% 相似待验证GPT-4处理一对长文本约需数秒和几美分,输出存在随机性需通过温度控制和多次采样提升稳定性66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/877300API
curl https://kongchang.com/api/v1/knowledge/claims/877300MCP
get_claim(id=877300)