模型
PersonaPlex
NVIDIA Nemotron语音模型系列中的语音到语音翻译模型,支持全双工处理
时间轴 (近 90 天)
9月15日
Moshi 及其衍生模型 PersonaPlex 是语音到语音(Speech-to-Speech)LLM,能够边听边说,实现并发生成
待验证50%
9月15日
在输入纯静默信号的五分钟片段测试中,Moshi 在 40 次测试中有 12 次出现不当开口,PersonaPlex 为 11/40
待验证50%
9月15日
该抑制方法成功抑制 Moshi 全部 13/13 次和 PersonaPlex 全部 9/9 次虚假开口
待验证50%
9月15日
该方法在两个模型上各 40/40 次真实回应全部保留,没有误杀
待验证50%
9月5日
F-Actor和PersonaPlex在需要从人设中推断行为时,指令遵循度分别下降了9.7%和4.5%
已过期50%
9月5日
研究团队在六个主流实时语音系统上进行了测试,包括F-Actor、PersonaPlex、GPT-Realtime、MiniCPM-o和Fun-Audio-Chat
已过期50%