今天跟大家分享一篇语音相关的论文合集:cs.SD语音7篇,eess.AS音频处理7篇。 cs.SD语音 【1】 TGAVC: Improving Autoencoder Voice Conversion with Text-Guided a…
声浪
文章来源于音频语音与语言处理研究组,作者张丽 说话人识别技术是根据语音辨别说话人身份的技术。随着深度学习技术的应用,说话人识别的性能取得了巨大的提升。然而说话人识别系统也面临着各种仿冒欺骗(spoofing)的威胁,如何构建具有欺骗感知能力…
这项技术未来在虚拟人、短视频玩法、客服服务、直播互动玩法上有着很大的落地空间。 来源丨机器之心 字节跳动智能创作语音团队 SAMI(Speech, Audio and Music Intelligence)近日发布了新一代的低延迟、超拟人的…
文章来源于音频语音与语言处理研究组,作者薛浏蒙 语音转换(Voice Conversion)旨在将源说话人语音中的音色转成目标说话人音色,同时保持源语音中的语言内容不变。在实际应用中,目标说话人所处的录音环境可能是嘈杂的,导致录制的目标说话…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音7篇,eess.AS音频处理7篇。 cs.SD语音 【1】 A Model You Can Hear: Audio Identification with Playable Prototy…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音7篇,eess.AS音频处理7篇。 cs.SD语音 【1】 Keyword Spotting System and Evaluation of Pruning and Quantizati…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音6篇,eess.AS音频处理6篇。 cs.SD语音 【1】 Audio-visual scene classification via contrastive event-object a…
来源丨作业帮语音技术团队 语音作为人与人交流的直接媒介,承载着人们日常生活中的大部分信息来源。基于近年来通信技术与物联网的发展,各式各样的语音助手、智能家具等软硬件层出不穷,人机交互技术的发展及人们对其需求日益攀升。语音识别技术在人机交互上…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音9篇,eess.AS音频处理10篇。 cs.SD语音 【1】 Audio Deepfake Detection Based on a Combination of F0 Informati…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音7篇,eess.AS音频处理7篇。 cs.SD语音 【1】 Multiple-hypothesis RNN-T Loss for Unsupervised Fine-tuning and…
