声浪
NaturalSpeech 3和支持语音属性分解的FACodec来了
近期,微软、中科大、港中大(深圳)、浙大等机构联合发布了一种全新的TTS系统——NaturalSpeech 3,它从语音数据的“表示”和“建模”两个角度出发,利用创新的属性分解扩散模型和属性分解语音神经编码器 FACodec,在零样本情况下…
55 0 0
SpeechColab Leaderboard:一个开源的语音识别评测平台
过去十年间,随着深度学习浪潮的兴起,语音识别(ASR)技术也受到了广泛关注,出现了众多可公开使用的语音识别系统。然而由于各种原因,对这些 ASR 系统进行公正、一致可复现的性能评估仍具有挑战。 在本文中,我们介绍了 SpeechColab…
86 0 0
Edge-TTS:微软推出的,免费、开源、支持多种中文语音语色的AI工具
Edge-TTS是由微软推出的文本转语音Python库,通过微软Azure Cognitive Services转化文本为自然语音。适合需要语音功能的开发者,GitHub上超3000星。作为国内付费TTS服务的替代品,Edge-TTS支持4…
137 0 0
