待验证50% 置信事实精确时间
通用ASR模型在呼叫中心场景中WER可能从通用场景的5%飙升至20-30%
1
来源数
50%
置信度
长期有效
时效性
2026/8/5
首次发现
来源
相关事实
待验证在ASR场景中,即使单一维度的分布偏移就可能导致WER增加50%以上,多维度偏移会使模型性能断崖式下降70% 相似待验证顶尖模型在SWE-bench上的解题率从2023年的不足5%跃升至2025年的30%以上62% 相似待验证中间层模型在MMLU、HumanEval等基准上通常能达到旗舰模型80%以上的得分,却只需不到30%的推理成本62% 相似待验证2023年初主流模型的SWE-bench得分普遍低于5%,到2025年中顶级模型已突破70%60% 相似待验证当前主流 ASR 引擎的通用词错率(WER)已降至5%以下,但在医疗垂直领域的专有名词上错误率可能飙升至15%-30%,除非进行领域微调和自定义词典配置60% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/692313API
curl https://kongchang.com/api/v1/knowledge/claims/692313MCP
get_claim(id=692313)