[控场AI]
模型v4

ElevenLabs v4

ElevenLabs推出的第四代语音合成模型,支持90种语言,具备10秒声音克隆能力和精细化情感表现力控制功能

时间轴 (近 90 天)

9月30日

ElevenLabs 发布 v4 与 v4 Turbo,覆盖 90 多种语言,Turbo 推理延迟约 100 毫秒,Instant Voice Clone 只需 10 秒音频即可复刻

待验证50%
9月28日

ElevenLabs v4 支持 90 种语言

待验证50%
9月28日

ElevenLabs v4 的核心升级集中在更精细的表现力控制和对 90 种语言的支持

待验证50%
9月28日

ElevenLabs 推出全新的 v4 语音合成模型

待验证50%
9月28日

关于 v4 的音质细节、延迟表现及与竞品的横向对比,尚缺乏充分的第三方评测数据

待验证50%
9月28日

部分语音服务商已引入声纹水印(Audio Watermarking)技术,将不可见标识嵌入合成音频以便溯源,但该机制是否在v4中应用尚未有公开说明

待验证50%
9月28日

将声音克隆所需样本压缩至10秒很可能借助了大规模预训练和少样本学习(Few-shot Learning)技术

待验证50%

全部知识事实 (7)

来源文章