ICASSP (International Conference on Acoustics, Speech, and Signal Processing) 是国际声学、语音和信号处理会议,亦为IEEE信号处理协会组织的年度旗舰会议。历届IC…
声浪
Meta 在近日的「用人工智能构建元宇宙」的讨论会上,展示了最新的 AI 黑科技 「Builder Bot」 ,并且在此次会议上 Meta 公布了关于构建元宇宙的人工智能计划,其中包括通用语言翻译系统、对话 AI 系统CAIRaoke,人工…
近期,由国际顶级语音会议ICASSP(International Conference on Acoustics, Speech, and Signal Processing,国际声学、语音与信号处理会议)和阿里巴巴集团联合举办的ICASS…
光动嘴,不出声,也能语音识别?康奈尔大学华人团队打造的智能项链不但做到了,而且中英文通用,识别准确率超过90%,奥秘在于装在项链内部的红外摄像头。 现有的语音识别技术可以让用户和Siri直接对话,问问明天的天气,或者让Alexa放首歌什么的…
近期,由浙江大学计算机学院赵洲老师团队开源的NATSpeech非自回归语音合成框架,在GitHub发布。 开源地址 https://github.com/NATSpeech/NATSpeech
本文将分享浙江大学计算机学院赵洲老师团队在AAAI-2022 论文中提出的DiffSpeech (用于语音合成)与DiffSinger (用于歌声合成)的官方Pytorch实现。
人工智能科学伊始,让机器「像人一样学习」始终是所有从业者的目标。人的智能基于多种感官与语言的通用处理能力,一直有研究者致力让机器做到此效果。 人的智识是「多模态学习」的总和,也就是可以跨越分类界限,理解和移用不同来源或形式的讯息与经验。 好…
第24届冬季奥林匹克运动会正如火如荼的进行中,细心的朋友可以发现在比赛的直播中有位AI手语主持人在为直播进行手语解说,用技术跨越声音的障碍。 AI手语主持人和被大家所了解的虚拟人一样,都有着以假乱真的外貌。从“她”的表情、口型、毛发、服饰、…
近日,在全球音频技术顶尖会议ICASSP 2022举办的AEC Challenge(Acoustic Echo Cancellation Challenge)回声消除比赛中,快手音视频技术团队在近端单讲音质、远端单讲回声消除、双讲音质和回声…
