gpt-sovits模型共50篇
什么是TTS TTS(Text-To-Speech)这是一种文字转语音的语音合成。类似的还有SVC(歌声转换)、SVS(歌声合成)等。目前GPT-SoVITS模型只有TTS功能,也就是不能唱歌。 GPT-SoVITS模型实现了: 由参考音频的情感、音色、语速控制合成音频的情感、音色、语速 可以少量语音微调训练,也可不训练直接推理 可以跨语种生成,即参考音频(训练集)和推理文本的语种为不同语种