Expired50% confidenceBenchmarkExact time
在PSP上运行90M参数模型的实测推理速度约为每秒0.5至0.6个token,生成一条完整回复需要1到3分钟
1
Sources
50%
Confidence
Short-term (~14 days)
Relevance
9/6/2026
First Seen
Valid until: 9/20/2026(expired)
Sources
Related Entities
Related Claims
Unverified专用安全分类模型的推理延迟可控制在200-500毫秒,配合量化技术和GPU推理优化可压缩至100毫秒级别71% similarUnverified大模型单次推理请求响应时间通常在1至30秒之间69% similarUnverifiedGoogle的RAIL模型指出用户对响应延迟的感知阈值约为100ms到1000ms,超过3秒则大概率放弃等待68% similarUnverifiedSFT单步耗时约0.5秒/步,DRAFT单步耗时约4.11秒/步,DRAFT单步耗时约为SFT的8倍66% similarUnverified预警响应延迟应≤2秒(从闭眼达标到发出声音/震动),超过3秒的产品在高速场景意义不大(120km/h下3秒已行驶约100米)66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/864619API
curl https://kongchang.com/api/v1/knowledge/claims/864619MCP
get_claim(id=864619)