Unverified50% confidenceFactExact time
现代云内网 RTT 可低至 0.1–0.5 毫秒,与本地 SSD 的 fsync 延迟处于同一量级
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
8/5/2026
First Seen
Valid until: 11/3/2026
Sources
Related Claims
UnverifiedGPT-4级别模型的首Token延迟(TTFT)可达500-2000ms,而Llama 3.1 8B等小模型TTFT可低至100-300ms72% similarUnverifiedLlama 3.1 8B Instruct在配备RTX 3090(24GB显存)的服务器上即可流畅运行,推理延迟通常在数秒以内69% similarUnverified云游戏(如GeForce Now、Xbox Cloud)和FPS对延迟敏感,应选2.4G无线接收器连接(延迟约8-16ms),蓝牙延迟通常60-100ms易掉帧;本地单机游戏蓝牙足够69% similarUnverified30-50 TPS是目前很多云端API服务的常见速度,大致接近人类正常阅读速度67% similarUnverifiedGPT-OSS 20B在RTX 3090上可达约40 Token/s的生成速度,在RTX 5090上能达到200 Token/s66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/689086API
curl https://kongchang.com/api/v1/knowledge/claims/689086MCP
get_claim(id=689086)