[控场AI]
模型VALL-E

VALL-E

微软于2023年发布的零样本语音合成模型,仅需3秒参考音频即可克隆目标人物声音

核心事实

时间轴 (近 90 天)

7月8日

2023年微软发布的VALL-E仅需3秒样本即可克隆说话人音色

已验证65%

来源文章