Unverified90% confidenceFactTime unknown
Fish Audio是一款基于深度学习的文本转语音(TTS)服务,支持多种音色克隆和自然语音合成
1
Sources
90%
Confidence
Long-term
Relevance
6/2/2026
First Seen
Sources
Coze工作流搭建:一键生成短视频完整教程
bilibiliA流AIGC
Related Entities
Related Claims
Unverified博主使用了名为「Fish Speech S2 Pro」的本地TTS模型来克隆真人声音为桌面宠物配音78% similarUnverifiedFish Speech是一个开源的文本转语音模型,其S2 Pro版本支持零样本和少样本声音克隆,只需几秒到几十秒的参考音频即可生成高度相似的合成语音77% similarUnverifiedFish Speech底层采用了VITS架构的改进版本,将文本编码、韵律预测和声码器整合在一个端到端的框架中71% similarUnverifiedFish Audio采用的技术路线支持零样本(Zero-shot)语音克隆,即只需少量参考音频即可复制特定音色69% similarUnverified现代TTS技术已从早期基于规则的拼接合成发展到基于深度学习的端到端语音生成,底层技术包括Transformer架构语音模型、神经网络声码器(WaveNet、HiFi-GAN)及韵律建模69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/37894API
curl https://kongchang.com/api/v1/knowledge/claims/37894MCP
get_claim(id=37894)