Unverified50% confidenceFactExact time
传统语音转文字(STT)技术依赖隐马尔可夫模型和高斯混合模型
1
Sources
50%
Confidence
Long-term
Relevance
8/31/2026
First Seen
Sources
Related Entities
Related Claims
Verified一次完整的语音AI交互涉及STT、LLM推理、TTS三个串行处理阶段77% similarUnverified流式STT在用户说话过程中就持续输出部分识别结果,而批量模式需等待完整音频才能开始处理75% similarUnverified早期ChatGPT语音采用级联架构,先语音转文字、再由大语言模型生成回答、最后转成语音播出75% similarUnverifiedMoonshine将语音转文本(STT)、意图识别、文本转语音(TTS)三项能力整合在同一框架中72% similarUnverifiedOpenAI的GPT-Live语音模型采用端到端架构,原始音频波形直接输入模型,模型直接输出音频,中间不再经过独立的ASR和TTS模块71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/830480API
curl https://kongchang.com/api/v1/knowledge/claims/830480MCP
get_claim(id=830480)