Unverified50% confidenceFactExact time
ASR是将人类语音转换为文本的技术,其核心架构经历了从高斯混合模型-隐马尔可夫模型(GMM-HMM)到端到端深度学习模型的演进
1
Sources
50%
Confidence
Long-term
Relevance
9/11/2026
First Seen
Sources
Related Entities
Related Claims
Unverified现代主流ASR系统多基于Transformer架构,通过在海量音频-文本对上进行监督学习建立声学特征与文字序列的映射关系79% similarVerified语音转文字技术经历了从传统隐马尔可夫模型(HMM)到深度学习的演进77% similarVerified传统语音AI普遍采用级联式架构,先用ASR将语音转文字,再交给语言模型处理,最后用TTS合成输出77% similarUnverified自动语音识别(ASR)底层通常采用端到端神经网络模型,如Whisper、Wav2Vec75% similarUnverifiedAI录音笔的转写加总结能力本质上是将语音识别ASR技术与大语言模型LLM串联部署的产物75% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/895544API
curl https://kongchang.com/api/v1/knowledge/claims/895544MCP
get_claim(id=895544)