活动与赛事

由上海交通大学听觉认知与计算声学实验室、卡内基梅隆大学、早稻田大学、布伦瑞克工业大学、Meta、Google Deepmind等单位联合举办的第三届URGENT语音增强挑战赛(Universality, Robustness, and Generalizability for EnhancemeNT)于9月1日正式开启!

为了进一步推动这一研究方向的发展。清华大学语音与语言技术中心(CSLT)联合北京邮电大学、北京海天瑞声科技股份有限公司以及语音之家,于2023年启动了首届中文连续视觉语音识别挑战赛(CNVSRC 2023)[2],并于次年继续举办了CNVSRC 2024 [3]。参赛者们贡献了许多新的思路和技术,极大地推进了这一方向在中文领域的发展。

由中国计算机学会主办、CCF语音对话与听觉专委会承办、语音之家协办、华为终端有限公司赞助的CCF先进音频技术大赛正式启动。大赛旨在推动国内高等院校及科研院所在音频技术领域的专业人才培养,支持学生科技创新,选拔优秀人才。


当前AI歌声转换(如AI孙燕姿)的核心瓶颈在于"音色可仿,唱法难摹"——形似易而神似难。为攻克这一难题,The Singing Voice Conversion Challenge 2025(SVCC2025挑战赛)正式启动,旨在推动AI语音合成技术发展。

由名古屋大学、南开大学、 Meta AI、日本国立信息通信技术研究所(NICT)等单位发起的 AudioMOS Challenge 2025 挑战赛将于2025年4月9日正式启动!

在语音研究领域,数据集的质量与可获取性是推动其发展的关键要素。可靠的模型构建高度依赖于高质量的数据支撑,这使得数据的采集和标注工作成为该领域研究的核心环节。

卡内基梅隆大学(CMU)、斯坦福大学(Stanford University)、乔治梅森大学 (George Mason University)、台湾大学与芝加哥丰田技术学院 (TTIC)的研究团队连手,在即将举行的 INTERSPEECH 2025 国际会议上推出了 ML-SUPERB 2.0 挑战赛(Multilingual SUPERB 2.0 Challenge)

由清华大学电子工程系多媒体信号与智能信息处理实验室、清华大学万科公共卫生与健康学院儿童青少年心理健康实验室、上海人工智能实验室联手举办的首届 SpeechWellness挑战赛

由上海交通大学听觉认知与计算声学实验室(AudioCC Lab)联合早稻田大学、卡内基梅隆大学、Meta、布伦瑞克工业大学等单位联合举办的URGENT 2025 语音增强挑战赛(Universality, Robustness, and Generalizability for EnhancemeNT)正式开启。

该赛事重点关注多模态多设备会议转录,旨在通过引入额外的模态信息(特别是视频模态)来突破当前技术的界限,并设有奖金。欢迎大家踊跃报名参加!

Speech Accessibility Project Challenge。该赛事旨在推动语音识别技术在构音障碍和发声障碍方面的快速发展,并设有奖金。欢迎大家踊跃报名参加!


CNVSRC 2024 (Chinese Continuous Visual Speech Recognition Challenge 2024) 是由 NCMMSC 2024 组委会发起,由清华大学、北京邮电大学、海天瑞声、语音之家联合承办的第二届视觉语音识别竞赛。本次竞赛的核心目的是验证当前视觉语音识别 (或称唇语识别) 技术在大词表连续识别场景下的性能。

由上海交通大学听觉认知与计算声学实验室(AudioCC Lab)联合卡内基梅隆大学、早稻田大学、Meta、布伦瑞克工业大学等单位联合举办的URGENT 2024 语音增强挑战赛(Universality, Robustness, and Generalizability for EnhancemeNT)正式开启,

自ASVspoof 2021三年之后,第五届ASVspoof挑战赛系列“ ASVspoof 5: 语音深伪检测和自动说话人验证挑战赛 ”现已正式启动并开放注册!本次挑战赛的成果和论文将有机会在Interspeech 2024的卫星研讨会上发表。

由中科院深圳先进技术研究院主持,协同中科院声学研究所发起的“多模态构音障碍严重程度自动评估挑战赛”(Multimodal Dysarthria Severity Assessment Challenge)将作为第十四届国际汉语口语处理研讨会(ISCSLP 2024)的旗舰赛事,正式启动!



Inspirational and Convincing Audio Generation Challenge 2024

第九届信也科技杯全球AI算法大赛开始报名啦!报名时间5月10日—6月3日,聚焦于语音深度鉴伪识别领域,旨在激发全球算法爱好者和专家的创新潜力,共同应对由人工智能技术发展带来的挑战。

