文章来源于小红书技术REDtech,作者郭浩瀚 解奉龙 小红书多媒体智能算法团队和香港中文大学首次联合提出了基于多阶段多码本紧凑型语音表征的高性能语音合成方案 MSMC-TTS。基于矢量量化变分自编码器(VQ-VAE)的特征分析器采用若干码…
声浪
今天跟大家分享一篇语音相关的论文合集:cs.SD语音6篇,eess.AS音频处理6篇。 cs.SD语音 【1】 Extract fundamental frequency based on CNN combined with PYIN 标题…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音8篇,eess.AS音频处理8篇。 cs.SD语音 【1】 LCSM: A Lightweight Complex Spectral Mapping Framework for Stere…
文章来源于音频语音与语言处理研究组,作者魏坤 语音识别(ASR)任务被广泛应用在车载、家居、会议等场景。对话语音识别(Conversational ASR)是ASR领域的一项重要工作,旨在将自然产生的对话语音转录成文本[1],这种场景在语音…
文章来源于阿里语音AI,作者达摩院语音实验室 本文介绍阿里在 INTERSPEECH 2021 发表的两篇论文工作:一种在预训练 (pre-training) 和微调 (fine-tuning) 中融合音素和文本信息的技术,提升下游 SLP…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音2篇,eess.AS音频处理2篇。 cs.SD语音 【1】 DDX7: Differentiable FM Synthesis of Musical Instrument Sounds 标…
本文介绍清华大学语音处理与机器智能实验室(Speech Processing and Machine Intelligence, SPMI)与美团的联合工作 — CUSIDE:分块、模拟未来、解码的流式语音识别新框架,刷新了目前Aishel…
回声消除(acoustic echo cancelation, AEC)是一项典型的语音信号处理任务。经典信号处理中的声学回声消除定义为:利用参考信号将麦克风信号中的回声消除。随着基于神经网络(neural network, NN)在AEC…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音10篇,eess.AS音频处理14篇。 cs.SD语音 【1】 Towards Cross-speaker Reading Style Transfer on Audiobook Data…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音7篇,eess.AS音频处理9篇。 cs.SD语音 【1】 Pure Data and INScore: Animated notation for new music 标题:纯数据和IN…
