IEEE 国际多媒体与博览会2026(ICME 2026)将于2026年7月在泰国曼谷举行。由昆山杜克大学、韩国科学技术院(KAIST)、墨尔本大学、约翰·霍普金斯大学以及Fortemedia联合发起的ESDD2:Environment-Aware Speech and Sound Deepfake Detection Challenge将与ICME 2026同期举办,目前已正式开放报名。

真实环境中录制的音频通常由两部分组成:
- 语音,指由主要前景说话人产生、具有语言意义的语音内容;
- 环境声音,指任何非语音的背景声音或非目标语音。
随着text-to-speech、voice conversion及其他生成模型的快速发展,这两种音频成分如今可以被独立修改。例如,在保持前景人类语音不变的情况下替换背景声音,或在保留背景环境的同时修改语音内容。此类组件级别的篡改比整体音频深度伪造更难检测,因为未被篡改的部分可能会误导检测系统,且此类组件级别的篡改对人类听感而言往往更加自然。

为应对这一挑战,我们发起了ESDD2: Environment-Aware Speech and Sound Deepfake Detection Challenge。ESDD2聚焦于音频组件级伪造场景,其中语音和环境声音可能被独立篡改或合成,从而构建更加困难且更贴近真实应用的检测任务。
欢迎学术界和工业界的研究人员参与本次挑战,共同探索面向该类深度伪造检测任务的鲁棒而有效的解决方案。鼓励参赛者提交不超过 4 页的短篇论文。一旦论文被接收,将收录并发表在会议workshop论文集中。
参与方式
- 挑战赛网站:https://sites.google.com/view/esdd-challenge/esdd-challenges/esdd-2/description
- 报名链接:https://forms.gle/WnkDkyiXtoVNMZRk7
- Google 群组:https://groups.google.com/g/esdd2-challenge
- 数据集下载:https://huggingface.co/datasets/XuepingZhang/ESDD2-CompSpoof-V2
- 基线代码:https://github.com/XuepingZhang/ESDD2-Baseline
- 提交平台:https://www.codabench.org/competitions/12365/
- 评测方案:https://arxiv.org/pdf/2601.07303
重要日期
| 2026.1.10 | 开放报名 |
| 2026.1.30 | 训练集、验证集和评测集发布;基线代码发布;验证集排行榜更新 |
| 2026.2.20 | 额外训练数据集申请截止 |
| 2026.3.20 | 测试集发布;最终评测阶段排行榜更新 |
| 2026.4.25 | 报名截止并冻结排行榜 |
| 2026.4.30 | 挑战赛论文提交截止 |
赞助与奖励
OfSpectrum, Inc.(https://ofspectrum.com/)是一家总部位于美国的人工智能公司,为本次挑战赛提供赞助,并将为第一名团队提供 1000 美元奖金。
