声浪
语音/音频处理学术速递[5.7]
今日论文合集:cs.SD语音13篇,eess.AS音频处理15篇。 本文经arXiv每日学术速递授权转载 cs.SD语音 【1】Deep Space Separable Distillation for Lightweight Acoust…
33 0 0
ICME2024 | 基于半监督对比学习的表现力语音合成
人类的语音极富表现力,不仅包括语调和重读,还包括风格和情感等多种元素。表现力语音合成的目标是要精准捕捉并再现这些元素。先前表现力语音合成方面的研究通常将表现力视为单一维度,如风格或情感。但实际上,风格可以随着文本和场景变化而变化,情感也可以…
25 0 0
迈向语音大模型的平权之路
什么样的事情最有价值?难且正确的事情。把 1B 级别的大模型优化到和 200M级别模型相同水平的 RTF 同时 WER 维持代差,难道不是一件该令人亢奋的事情吗? --向前看,别回头 在两个月前的年度总结中,WeNet 社区已经开始向着更“…
114 0 0
