2020年,爱奇艺联合北京希尔贝壳科技有限公司、西北工业大学音频语音与语言处理研究组、清华大学深圳国际研究生院、新加坡国立大学、起源智能在ICASSP2021举办多说话人多风格音色克隆大赛——M2VoC,旨在提供一个通用的数据集以及一个公平…

最新声浪
查看全部 →Yoshua Bengio团队推出开源语音处理工具包 ——SpeechBrain。 地址: GitHub:https://github.com/speechbrain/speechbrain 官网:https://speechbrain.g…
清华大学国家研究中心语音和语言技术团队撰写的《语音识别基本法》一书由电子工业出版社出版,张景中院士为该书做序。目前,该书已在京东、天猫等各大网站上架销售! 全书共256页,约30万字,共13章。本书结合当下使用广泛的Kaldi语音平台,对语…
打造实时对话式AI服务,NVIDIA发布Jarvis 1.0公测版。 据智东西报道,凭借听、读、译三大功能,对话式人工智能(AI)正逐渐深入人们的生活,成为解放双手和提高生产力的关键工具。 当你说话时,对话式AI能实时将你说的话记录成文字,…
此次讲座从时频遮蔽的音频盲源分离基本原理开始,分析了经典时频遮蔽音频盲源分离方法的优势与局限性,随后讨论了最新深度学习方法应用在时频遮蔽音频盲源分离方向上的研究进展与瓶颈问题。最后分享了一些常用的音频盲源分离性能测试数据库,并探讨了今后音频…
《麻省理工科技评论》“十大突破性技术” 榜单迎来诞生二十周年的日子。2021“十大突破性技术” 发布会也于今天下午在杭州余杭未来科技城举办。 本次会议由中共杭州市余杭区委、杭州市余杭区人民政府、《麻省理工科技评论》主办,浙江省委组织部(人才…
AI虐我千百遍,我待AI如初恋。什么才是好AI?答:能落地的AI才是好AI。AI项目从无到有,最终落地开花,无非不是挖坑、踩坑、填坑的过程。本文从笔者的一些经历、经验、血泪教训展开,说一下AI项目研发过程中的感想。 被虐的案例 案例1:经过…
Facebook、哥伦比亚大学、佐治亚理工学院和达特茅斯大学的研究人员共同开发了一个框架——Vx2Text。这个框架可以帮助我们,从视频、音频等输入内容中提取信息,再以人类可以理解的文字,生成字幕或者回答问题等。 论文地址:https://…
滴滴是一个让出行变得更美好的公司,语音交互作为出行领域最安全,最自然的交互方式在滴滴内部有着广泛的应用前景,目前滴滴语音交互已经应用在智能外呼,司机端,地图,车机系统多个领域中。语音交互离不开自然语言理解,用户说的每一句话都应该得到正确的理…
