Unverified50% confidenceFactExact time
端到端语音架构的早期探索可追溯到2014年前后Google提出的Sequence-to-Sequence模型,以及2016年百度提出的Deep Speech 2
1
Sources
50%
Confidence
Long-term
Relevance
7/20/2026
First Seen
Sources
Related Claims
UnverifiedGoogle于2023年发布的AudioPaLM率先将语音token直接注入语言模型词汇表,实现文本与音频在同一表示空间中联合建模78% similarUnverified工具增强语言模型(Tool-Augmented Language Model,TALM)最早的系统性论述可追溯至 2022 年 Google 发表的同名论文68% similarUnverified谷歌翻译早期的重大突破很大程度上依赖海量平行语料库(双语成对文本)66% similarUnverifiedGoogle Brain团队2012年发表了DNN-HMM混合模型,代表深度神经网络语音识别系统65% similarUnverifiedGoogle早期发布的Micro Speech示例模型仅约18KB,能在微控制器上实时识别yes和no等简单指令63% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/570040API
curl https://kongchang.com/api/v1/knowledge/claims/570040MCP
get_claim(id=570040)