待验证65% 置信事实时间未知
通过中转访问海外模型的延迟通常为300-800ms
1
来源数
65%
置信度
中期 (~90 天)
时效性
2026/6/3
首次发现
有效期至:2026/9/1
来源
Claude Code模型配置与费用对比:省钱实战攻略
bilibili小伍不是码牛
相关事实
待验证国内用户访问OpenAI、Anthropic等海外大模型服务时,跨太平洋传输的基础延迟(RTT)通常在150-300毫秒之间73% 相似待验证访问主内存的延迟高达200-300个时钟周期71% 相似待验证本地执行的联动响应延迟通常低于300ms,云端往返执行延迟普遍500ms-2s,对灯光/开关等即时反馈场景,本地执行体验差异明显71% 相似待验证本地部署延迟由三段构成:faster-whisper在GPU上STT约100-300ms、7B参数LLM首Token约200-500ms、TTS合成约100-300ms69% 相似待验证小模型推理延迟约500ms,而向量匹配延迟仅30-100ms68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/40077API
curl https://kongchang.com/api/v1/knowledge/claims/40077MCP
get_claim(id=40077)