本文主要是介绍关于GPT-SoVITS语音合成的效果展示(西游之西天送葬团),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!
目录
- 使用效果总结
- 合成效果展示
使用效果总结
使用的是2024年03月21日22点28分更新的版本。
使用起来很方便,从它“自带界面”这点就能看出,易于使用也是目的之一,而且从训练到推理的每个步骤都能在界面中完成。
集成了多个实用工具,包括语音伴奏分离、训练集自动分割、中文ASR和文本标注,帮助初学者创建训练数据集和GPT/SoVITS模型。
合成效果虽然需要抽卡,但参数不变的情况下,也很稳定,几乎都没有大变化,每次都能抽到好卡。
不像VITS那样,GPT-SoVITS完全没有大佐口音,并且有较好的感情表达。
推理速度则不尽人意,比VITS要慢一些。
有个缺点,也可以说是bug。GPT-SoVITS在推理是需要一段5到10秒的参考音频,当要合成的文本字数大于参考语言的总字数时,就可能在合成音频中出现一截参考音频。据开发者在issue中回复,回音参考泄露的问题时有发生,原因也挺多的,建议更换参考音频和缩短合成文本。
效果上依然和微软的语音合成有些差距,但时比VITS要好上不少。
合成效果展示
链接:西游之西天送葬团
提取码:ztjk
这篇关于关于GPT-SoVITS语音合成的效果展示(西游之西天送葬团)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!