声浪
DiaMoE-TTS:一种基于 MoE 的多方言 TTS 框架
无论是中文的粤语、闽南话、吴语,还是欧洲的荷兰比尔茨语方言、法国奥克语,亦或是非洲和南美的地方语言,方言都承载着独特的音系与文化记忆,是人类语言多样性的重要组成部分。然而,许多方言正在快速消失,语音技术如果不能覆盖这些语言,势必加剧数字鸿沟…
57 0 0
Qwen深度研究一夜升级!可生成网页和音频播客,新模型能认医生手写体
来源丨量子位 Qwen版深度研究加速进化,一觉起来增加了听觉和视觉输出: 可以生成网页和音频了。 AI深度研究整合的内容,变成图文并茂的网页,还可以一键部署,任何人可凭链接查看,方便对外展示。 长篇文字内容也可以变成音频播客,方便自己在碎片…
21 0 0
豆包语音合成模型2.0发布,语义理解+情感演绎双突破
今天,火山引擎发布了豆包语音合成模型2.0(Doubao-Seed-TTS 2.0)和豆包声音复刻模型2.0(Doubao-Seed-ICL 2.0)。此次升级基于豆包大语言模型研发语音合成新架构,让合成和复刻的声音都能解锁深度语义理解和上…
29 0 0
