1.GPT-SoVITS

GPT-SoVITS,目前主流模型,可以支持语种有:英语、日语和中文。支持声音复刻。很多公司目前的大模型基本都是这个。

地址:https://github.com/RVC-Boss/GPT-SoVITS


2. Fish Speech

Fish Speech v1.2终于发布了,效果稳定非常好,支持声音复刻。经过三十万小时语音数据,可以支持英语、中文和日语。架构如下:


新的主站地址:https://fish.audio/zh-CN/

代码地址:https://github.com/fishaudio/fish-speech


3. ChatTTS

一炮走红的模型,一直非常火的模型结果,用了大概4w小时数据。支持多人的对话式语音合成,目前仅仅支持中英文,韵律效果非常好。

地址:https://github.com/2noise/ChatTTS


4.HuggingFace的Parler-TTS

可以控制音调、速度、性别、噪音水平、情绪特征等等

地址:https://github.com/huggingface/parler-tts


5.OpenVoice

支持的语种有:英语、西班牙语、法语、中文、日语和韩语。可以控制语音风格和声音复刻功能。

地址:https://github.com/myshell-ai/OpenVoice


其他的还有:

此外,还有字节的Seed-TTS、微软最新的合成VALLE-2等等。

以上内容部分来自微博用户AIGCLINK