Dia是一款开源的语音生成模型,参数规模为1.6B。该模型专注于对话音频生成,能够合成逼真的双人对话音频内容,支持多角色语音输出。Dia具备较强的自然语音表现力,适用于播客生成、对话数据合成及语音交互等应用场景。
Dia的模型参数量为1.6B(16亿)
Dia能根据输入文本自动生成两人对话音频,可模拟咳嗽声、笑声等非语言细节