本文将分享浙江大学计算机学院赵洲老师团队在AAAI-2022 论文中提出的DiffSpeech (用于语音合成)与DiffSinger (用于歌声合成)的官方Pytorch实现。
声浪
人工智能科学伊始,让机器「像人一样学习」始终是所有从业者的目标。人的智能基于多种感官与语言的通用处理能力,一直有研究者致力让机器做到此效果。 人的智识是「多模态学习」的总和,也就是可以跨越分类界限,理解和移用不同来源或形式的讯息与经验。 好…
某TTS领域明星创业公司 招聘岗位 语⾳合成算法⼯程师 工作地点:北京建外SOHO 岗位要求 需要有 1-3 年⼯作经验的年轻有潜⼒的中坚⼒量,或者在读研、读博时就是在⽐较好的⾼校团队, 做 TTS 领域研究的新⼈。 工作内容
禾苗通信 禾苗通信成立于2009年9月,于2019年11月在香港主板上市(股票代码:HK.01401),是一家以智能终端产品、IOT智能硬件和云计算为主要核心业务,集设计研发、生产制造、销售服务为一体的公司,年均营业额为30亿;目前公司员工…
第24届冬季奥林匹克运动会正如火如荼的进行中,细心的朋友可以发现在比赛的直播中有位AI手语主持人在为直播进行手语解说,用技术跨越声音的障碍。 AI手语主持人和被大家所了解的虚拟人一样,都有着以假乱真的外貌。从“她”的表情、口型、毛发、服饰、…
近日,在全球音频技术顶尖会议ICASSP 2022举办的AEC Challenge(Acoustic Echo Cancellation Challenge)回声消除比赛中,快手音视频技术团队在近端单讲音质、远端单讲回声消除、双讲音质和回声…
在深度学习、大数据和大算力的推动下,以语音增强、识别和合成为代表的智能语音技术已经在众多应用中落地。特为大家整理了一些比较前沿的报告,文末可免费获取。 No.1
去年起,美国政府开始认真对待机器人来电问题。2021 年 6 月 30 日起,联邦通信委员会 FCC 要求电话提供商使用一种名为 STIR/SHAKEN 的基于加密协议的方式来验证所有来电者的 ID。 和往常一样,这种方法并没有治本,任何期…
近日,由快手音视频技术部联合意大利罗马第一大学(Sapienza University of Rome, Italy),在国际音频顶级会议 ICASSP 2022 上发起的深度3D音频信号处理挑战赛(L3DAS22:Machine Lear…
目前的语音合成系统大多基于单一说话人单一风格语音数据建模,但随着语音合成应用场景的不断扩展,对多风格语音合成的需求越来越大。然而单人多风格数据难以获取,一来成本高,二来不是每个发音人都能完成不同风格的录制。一种最直接的方式是通过语音风格迁移…
