待验证75% 置信事实时间未知
中心化API(如OpenAI)的首Token延迟(TTFT)通常在200-500毫秒之间
1
来源数
75%
置信度
长期有效
时效性
2026/6/1
首次发现
来源
EverClaw深度解析:质押MOR代币获取永久AI推理的去中心化平台
githubprofbernardoj
涉及实体
相关事实
待验证主流云端LLM API的平均首Token时间(TTFT)通常在500毫秒至2秒之间82% 相似待验证当前主流大模型在处理复杂代码任务时,首token延迟(TTFT)往往在2-8秒之间78% 相似待验证云端 TTS 服务的首字节响应时间通常为 200-500 毫秒,是延迟瓶颈的主要来源78% 相似待验证国内用户访问OpenAI、Anthropic等海外大模型服务时,跨太平洋传输的基础延迟(RTT)通常在150-300毫秒之间75% 相似待验证云端TTS服务的首字节响应时间通常200-500毫秒,本地部署的轻量TTS模型(如Piper、Kokoro-82M)可将延迟压至50毫秒以内,但音质通常略逊73% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/29536API
curl https://kongchang.com/api/v1/knowledge/claims/29536MCP
get_claim(id=29536)