Unverified85% confidenceDecision RuleTime unknown
实时字幕/会议同传场景需选择延迟≤500ms且支持流式识别的产品;离线批量转写则应优先准确率而非实时性,两者引擎优化方向不同
1
Sources
85%
Confidence
Long-term
Relevance
-
First Seen
Sources
Related Entities
Related Claims
Unverified实时转写(边说边出字)对延迟和网络要求高,且准确率通常低于事后上传转写;如果不需要现场看字幕,选事后转写模式准确率更有保障76% similarVerified实时语音对话中的检索增强生成通常要求端到端延迟控制在500毫秒以内以维持自然对话节奏76% similarUnverified准确率与响应速度存在权衡:大模型语音识别(如基于Transformer的端到端模型)准确率更高但延迟大,实时低延迟场景往往用轻量声学模型牺牲2-3个百分点准确率换取速度74% similarUnverified双向语音存在延迟,全双工(可同时说和听)机型体验远好于半双工;延迟>1.5秒时宠物会因声音与画面不同步而困惑,选标注端到端延迟<500ms的机型72% similarUnverified实时语音反馈的价值取决于延迟——优质产品动作识别到语音提示延迟应<1秒,超过2秒的反馈会滞后于动作导致纠错失去意义72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/475867API
curl https://kongchang.com/api/v1/knowledge/claims/475867MCP
get_claim(id=475867)