[控场AI]
模型Voxtral

Voxtral TTS

Mistral推出的开源权重文本转语音(TTS)模型,支持多语言与方言,具备情感表达能力、低延迟流式合成以及音色自定义功能

时间轴 (近 90 天)

9月12日

Mistral推出了Voxtral TTS,一款定位于「前沿开源权重」的文本转语音模型

待验证50%
9月12日

Voxtral TTS以开放权重的形式发布,开发者可以获取模型参数、进行本地部署和二次开发

待验证50%
9月12日

Voxtral TTS主打三个核心能力:自然且富有情感表达的语音、多语言支持,以及极低的合成延迟

待验证50%
9月12日

Voxtral TTS支持9种语言,并声称能够准确捕捉多样的方言

待验证50%
9月12日

Voxtral TTS强调具备极低的延迟表现(very low latency)

待验证50%
9月12日

Voxtral TTS支持便捷地适配新的音色(easily adaptable to new voices)

待验证50%
9月12日

开源权重使开发者可以在本地完成音色微调,避免将声纹数据上传至第三方服务,在隐私与合规方面更有保障

待验证50%
9月12日

Voxtral TTS目前缺乏第三方评测、具体参数规模、许可协议细节等公开数据

待验证50%

全部知识事实 (8)

来源文章