今天跟大家分享一篇语音相关的论文合集:cs.SD语音9篇,eess.AS音频处理9篇。 cs.SD语音 【1】 Learning Unsupervised Hierarchies of Audio Concepts 标题:学习音频概念的无监…
声浪
今天跟大家分享一篇语音相关的论文合集:cs.SD语音7篇,eess.AS音频处理8篇。 cs.SD语音 【1】 STOP: A dataset for Spoken Task Oriented Semantic Parsing 标题:STO…
来源丨https://zhuanlan.zhihu.com/p/534840415 作者丨孙思宁 本文主要是基于我们即将发表于Interspeech2022的文章 “CaTT-KWS: A Multi-stage Customized Ke…
来源丨https://zhuanlan.zhihu.com/p/531934889 作者丨孙思宁 本文主要基于我们之前发表的论文“Tiny Transducer: A Highly-Efficient Speech Recognition…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音9篇,eess.AS音频处理9篇。 cs.SD语音 【1】 Fine-grained Early Frequency Attention for Deep Speaker Recognit…
文章来源于音频语音与语言处理研究组,作者杨展恒 关键词识别(Keyword Spotting,KWS)旨在从连续的音频流中检测特定的关键词,被广泛应用于各种端侧设备中作为语音交互的入口组件,例如智能家居的设备唤醒(WuW)和设备操控(Com…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音5篇,eess.AS音频处理6篇。 cs.SD语音 【1】 Machine-learning applied to classify flow-induced sound paramete…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音11篇,eess.AS音频处理11篇。 cs.SD语音 【1】 Style Transfer of Audio Effects with Differentiable Signal Pro…
天聪智能 ASV-Subtools是厦门大学智能语音实验室(XMUSPEECH)于2020年6月推出的一套高效、易于扩展的声纹识别开源工具,该工具是基于Kaldi与Pytorch开发的,充分结合了Kaldi 在语音信号和后端处理的高效性以及…
一年一度的全球语音大会INTERSPEECH 2022论文评选结果已经揭晓,我们的论文I《KaraTuner: Towards end to end natural pitch correction for singing voice in…
