待验证50% 置信事实精确时间
Google的AudioLM(2022)和Meta的SeamlessM4T(2023)验证了直接在音频域进行建模的可行性
1
来源数
50%
置信度
长期有效
时效性
2026/7/20
首次发现
来源
相关事实
待验证Google 的 AudioPaLM 是直接实现音频到音频映射的端到端语音模型76% 相似待验证端到端语音架构的先驱包括 Google 的 AudioLM(2022)和 Meta 的 Voicebox(2023)73% 相似待验证Diffusers支持AudioLDM等音频扩散模型,能够根据文本描述生成音乐和音效71% 相似待验证语音编码器 + LLM 解码器的组合是 2023 年以来语音大模型的主流范式,Qwen-Audio、Gemini Audio、Phi-4-audio 等均采用类似设计70% 相似待验证2023年Meta AI发表研究证明可用MEG脑磁图数据解码连续语音69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/570448API
curl https://kongchang.com/api/v1/knowledge/claims/570448MCP
get_claim(id=570448)