Unverified50% confidenceFactExact time
STT模型在低信噪比场景下不会承认听不清,而是倾向于编造合理但错误的词句(产生幻觉)
1
Sources
50%
Confidence
Long-term
Relevance
9/17/2026
First Seen
Sources
Related Entities
Related Claims
Unverified传统语音转文字(STT)技术依赖隐马尔可夫模型和高斯混合模型73% similarUnverified流式STT在用户说话过程中就持续输出部分识别结果,而批量模式需等待完整音频才能开始处理70% similarUnverified研究表明,Whisper 在静音段产生幻觉的概率尤为突出,转录结果流畅但内容与原音不符67% similarUnverified编解码器模拟能覆盖可预测、可参数化的信道层面失真,但无法解决背景噪声组合、自然语音重叠和情绪化声学偏移66% similarUnverified降噪算法越激进,安静环境下的言语细节和自然度损失越多,可能听起来发闷失真;追求极致降噪会牺牲声音的真实感66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/928094API
curl https://kongchang.com/api/v1/knowledge/claims/928094MCP
get_claim(id=928094)