待验证50% 置信发布精确时间
英伟达推出AUDEX-310音频统一模型,总参数量达300亿但激活参数仅30亿,采用稀疏激活架构,支持语音识别、翻译与情感分析
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/13
首次发现
有效期至:2026/10/11
来源
GPT-5.6与Grok 4.5同日对决,旗舰AI模型密集发布周
bilibiliMowaaaa2026/7/8
相关事实
待验证微软 2023 年发布的 VALL-E 将语音生成建模为语言模型问题,仅需 3 秒参考音频即可实现零样本克隆,采用 EnCodec 神经音频编解码器68% 相似待验证Auro-3D采用基于声道的分层布局(不同于Atmos的对象音频),支持它的机型较少,主要集中在Marantz和Denon高端线,普通用户三格式全支持并非刚需66% 相似待验证经过大规模音频-频谱图配对数据训练的AI模型不仅能从频谱图还原通用语音,还能捕捉说话人的音色特征、口音和情绪状态65% 相似待验证选择支持AI声纹识别(区分哭声与环境噪音)的型号,纯分贝触发式误报率可达30%以上,AI识别型误报率通常低于10%65% 相似待验证ARR采用多维度打分体系,包括Soundness和Excitement等指标63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/497039API
curl https://kongchang.com/api/v1/knowledge/claims/497039MCP
get_claim(id=497039)