IEEE 国际多媒体与博览会2026(ICME 2026)将于2026年7月在泰国曼谷举行。由昆山杜克大学、韩国科学技术院(KAIST)、墨尔本大学、约翰·霍普金斯大学以及Fortemedia联合发起的ESDD2:Environment-Aware Speech and Sound Deepfake Detection Challenge将与ICME 2026同期举办,目前已正式开放报名。

真实环境中录制的音频通常由两部分组成:

  1. 语音,指由主要前景说话人产生、具有语言意义的语音内容;
  2. 环境声音,指任何非语音的背景声音或非目标语音。

随着text-to-speech、voice conversion及其他生成模型的快速发展,这两种音频成分如今可以被独立修改。例如,在保持前景人类语音不变的情况下替换背景声音,或在保留背景环境的同时修改语音内容。此类组件级别的篡改比整体音频深度伪造更难检测,因为未被篡改的部分可能会误导检测系统,且此类组件级别的篡改对人类听感而言往往更加自然。

为应对这一挑战,我们发起了ESDD2: Environment-Aware Speech and Sound Deepfake Detection Challenge。ESDD2聚焦于音频组件级伪造场景,其中语音和环境声音可能被独立篡改或合成,从而构建更加困难且更贴近真实应用的检测任务。

欢迎学术界和工业界的研究人员参与本次挑战,共同探索面向该类深度伪造检测任务的鲁棒而有效的解决方案。鼓励参赛者提交不超过 4 页的短篇论文。一旦论文被接收,将收录并发表在会议workshop论文集中。

参与方式

重要日期

2026.1.10开放报名
2026.1.30训练集、验证集和评测集发布;基线代码发布;验证集排行榜更新
2026.2.20额外训练数据集申请截止
2026.3.20测试集发布;最终评测阶段排行榜更新
2026.4.25报名截止并冻结排行榜
2026.4.30挑战赛论文提交截止

赞助与奖励

OfSpectrum, Inc.(https://ofspectrum.com/)是一家总部位于美国的人工智能公司,为本次挑战赛提供赞助,并将为第一名团队提供 1000 美元奖金。