待验证50% 置信事实精确时间
现代云内网 RTT 可低至 0.1–0.5 毫秒,与本地 SSD 的 fsync 延迟处于同一量级
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/5
首次发现
有效期至:2026/11/3
来源
相关事实
待验证GPT-4级别模型的首Token延迟(TTFT)可达500-2000ms,而Llama 3.1 8B等小模型TTFT可低至100-300ms72% 相似待验证Llama 3.1 8B Instruct在配备RTX 3090(24GB显存)的服务器上即可流畅运行,推理延迟通常在数秒以内69% 相似待验证云游戏(如GeForce Now、Xbox Cloud)和FPS对延迟敏感,应选2.4G无线接收器连接(延迟约8-16ms),蓝牙延迟通常60-100ms易掉帧;本地单机游戏蓝牙足够69% 相似待验证30-50 TPS是目前很多云端API服务的常见速度,大致接近人类正常阅读速度67% 相似待验证GPT-OSS 20B在RTX 3090上可达约40 Token/s的生成速度,在RTX 5090上能达到200 Token/s66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/689086API
curl https://kongchang.com/api/v1/knowledge/claims/689086MCP
get_claim(id=689086)