GPT-SoVITS,目前主流模型,可以支持语种有:英语、日语和中文。支持声音复刻。很多公司目前的大模型基本都是这个。
2. Fish Speech

代码地址:https://github.com/fishaudio/fish-speech
3. ChatTTS
地址:https://github.com/2noise/ChatTTS
4.HuggingFace的Parler-TTS
地址:https://github.com/huggingface/parler-tts
5.OpenVoice
地址:https://github.com/myshell-ai/OpenVoice
其他的还有:
MARS5可以为体育解说、动漫等韵律复杂和多样化的场景生成语音
地址:https://github.com/Camb-ai/MARS5-TTS MetaVoice-1B支持多语言,在英语处理上实现了情感语音节奏等。
地址:https://github.com/metavoiceio/metavoice-src EmotiVoice支持中英文双语,包含二千多种不同的音色
此外,还有字节的Seed-TTS、微软最新的合成VALLE-2等等。
