待验证50% 置信基准精确时间
在Code-switching(语言混合切换)场景下,当前最优语音识别模型的词错误率(WER)仍在15-25%之间,而英语单语场景WER在5%以内
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/11
首次发现
有效期至:2026/12/10
来源
涉及实体
相关事实
待验证翻译机存在识别-翻译两段延迟叠加,方言、口音重或语速快时识别错误会直接导致翻译错误,非标准普通话/带口音用户实测准确率明显下降74% 相似已验证OpenAI Whisper、Google Speech-to-Text等ASR模型已将词错误率压缩至5%以下70% 相似待验证在一个平衡的 13 种方言 ASR 测试中,突尼斯方言的词错误率(WER)高达 0.478,是所有方言中最高的70% 相似待验证传统三段式语音管线中每个模块独立训练,误差会逐级累积,且文字化过程会不可逆地丢失说话者的语调、停顿、情绪等副语言信息69% 相似待验证端侧多语种语音识别在处理夹杂英文技术名词的非英语口述时,会将英文术语按发音音译成本地文字69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/891707API
curl https://kongchang.com/api/v1/knowledge/claims/891707MCP
get_claim(id=891707)