Voxtral TTS
Mistral推出的开源权重文本转语音(TTS)模型,支持多语言与方言,具备情感表达能力、低延迟流式合成以及音色自定义功能
时间轴 (近 90 天)
Mistral推出了Voxtral TTS,一款定位于「前沿开源权重」的文本转语音模型
Voxtral TTS以开放权重的形式发布,开发者可以获取模型参数、进行本地部署和二次开发
Voxtral TTS主打三个核心能力:自然且富有情感表达的语音、多语言支持,以及极低的合成延迟
Voxtral TTS支持9种语言,并声称能够准确捕捉多样的方言
Voxtral TTS强调具备极低的延迟表现(very low latency)
Voxtral TTS支持便捷地适配新的音色(easily adaptable to new voices)
开源权重使开发者可以在本地完成音色微调,避免将声纹数据上传至第三方服务,在隐私与合规方面更有保障
Voxtral TTS目前缺乏第三方评测、具体参数规模、许可协议细节等公开数据
全部知识事实 (8)
Voxtral TTS目前缺乏第三方评测、具体参数规模、许可协议细节等公开数据
50%待验证Voxtral TTS以开放权重的形式发布,开发者可以获取模型参数、进行本地部署和二次开发
50%待验证Voxtral TTS主打三个核心能力:自然且富有情感表达的语音、多语言支持,以及极低的合成延迟
50%待验证Voxtral TTS支持9种语言,并声称能够准确捕捉多样的方言
50%待验证Voxtral TTS强调具备极低的延迟表现(very low latency)
50%待验证Voxtral TTS支持便捷地适配新的音色(easily adaptable to new voices)
50%待验证开源权重使开发者可以在本地完成音色微调,避免将声纹数据上传至第三方服务,在隐私与合规方面更有保障
50%待验证Mistral推出了Voxtral TTS,一款定位于「前沿开源权重」的文本转语音模型
50%