Unverified50% confidenceBenchmarkExact time
在公开的中文医疗ASR基准测试中通用模型的医疗术语召回率通常在70%-85%之间
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
8/5/2026
First Seen
Valid until: 11/3/2026
Sources
Related Claims
Unverified普通话通用场景识别准确率≥95%已是主流水平,选购时应重点看专业领域/口音/多人会议等复杂场景的实测准确率,官方宣称的98%通常是标准朗读环境数据62% similarVerifiedLLM-as-Judge方法与人类专家评分的一致性可达80%以上62% similarUnverified2024年的多项研究表明,LLM裁判与人类专家的一致率通常在70%-85%之间61% similarUnverified中文垂直场景(医疗/法律/金融)应选支持热词/自学习模型的API,通用模型在专业术语上识别率可能骤降10-20个百分点,热词功能可显著挽回准确率60% similarUnverifiedLLM-as-Judge方法由Zheng等人在2023年的MT-Bench论文中系统验证,与人类评估的一致性可达80%以上60% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/687633API
curl https://kongchang.com/api/v1/knowledge/claims/687633MCP
get_claim(id=687633)