声浪
由CCF语音对话与听觉专委会 、中国人工智能产业发展联盟(AIIA)评估组 、58同城AI Lab、语音之家(北京)科技有限公司、北京希尔贝壳科技有限公司共同主办的【语音之家】走进企业系列沙龙-语音技术在58同城的应用,将于2021年8月3…
Facebook Al发布 Multilingual LibriSpeech(MLS),MLS提供超过50000小时的音频包含八种语言。 OpenSLR:www.openslr.org/94 Facebook Al is releasing…
WACV 2021的录用论文Visual Speech Enhancement Without A Real Visual Stream。该文研究涉及计算机视觉与语音处理的交叉。 论文信息 语音增强是语音处理的经典研究内容,以往的语音增强往…
写在前面 图片本文作者是斯坦福Andrew Ng的博士,比较代表性的工作包括在baidu的Deep speech/Deep speech2、在facebook的wav2letter++等,google scholar引用一万多的大佬,现在在…
语音转换(Voice Conversion)指在保留语言内容的同时,将源说话人语音转换成目标说话人的语音。由于深度学习强大的非线性建模能力,基于深度学习的语音转换取得了巨大的飞跃。近年来,零资源语音转换受到越来越多的关注。对比传统的GMM…
声明:语音合成论文优选系列主要分享论文,分享论文不做直接翻译,所写的内容主要是我对论文内容的概括和个人看法。如有转载,请标注来源。 文章同列统计可访问:http://yqli.tech/page/tts_paper.html RW-Resn…
经超哥同意,接下来几篇文章将转载超哥写的《Wenet网络设计与实现》。感兴趣的读者可以关注知乎杨超,同时wenet1.0正式发布( wenet1.0正式发布:更快更高更强更有生产力https://mp.weixin.qq.com/s/CG6…
智能语音是人工智能的重要分支与热门领域。随着语音识别技术的落地,智能语音已成为人与机器交互的重要方式,被广泛应用于智能手机、智能家居、智能机器人、智能汽车等智能化终端设备中。 从技术知识的角度看,语音识别具有更为典型的跨学科特点,涉及到了声…
声明:平时看些文章做些笔记分享出来,文章中难免存在错误的地方,还望大家海涵。平时搜集一些资料,方便查阅学习:http://yqli.tech/page/speech.html。如转载,请标明出处。 Dyn-ASR: Compact, Mul…
