Unverified50% confidenceFactExact time
Google的AudioLM(2022)和Meta的SeamlessM4T(2023)验证了直接在音频域进行建模的可行性
1
Sources
50%
Confidence
Long-term
Relevance
7/20/2026
First Seen
Sources
Related Claims
UnverifiedGoogle 的 AudioPaLM 是直接实现音频到音频映射的端到端语音模型76% similarUnverified端到端语音架构的先驱包括 Google 的 AudioLM(2022)和 Meta 的 Voicebox(2023)73% similarUnverifiedDiffusers支持AudioLDM等音频扩散模型,能够根据文本描述生成音乐和音效71% similarUnverified语音编码器 + LLM 解码器的组合是 2023 年以来语音大模型的主流范式,Qwen-Audio、Gemini Audio、Phi-4-audio 等均采用类似设计70% similarUnverified2023年Meta AI发表研究证明可用MEG脑磁图数据解码连续语音69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/570448API
curl https://kongchang.com/api/v1/knowledge/claims/570448MCP
get_claim(id=570448)