赛事官网:https://www.wavlab.org/activities/2024/Interspeech2024-Discrete-Speech-Unit-Challenge/
对于离散表征的提取,本次比赛允许使用任何数据(但不可以包含参赛任务中的测试集)和预训练模型;但对于具体的识别和合成系统,我们只允许用比赛指定的数据集训练。为了帮助参赛者,我们在语音框架ESPnet中提供了对应的基线系统和工具包。
本次挑战赛同时也是Interspeech2024的special issue,也会接受除了挑战赛系统介绍之外的研究论文(具体论文要求和Interspeech2024 论文一致)。论文的主题可以是下面任何关于语音、音频离散表征的研究:
离散语音、音频或音乐表征学习 离散表征在语音、音频下游任务(如ASR、TTS等)中的使用 离散语音、音频表征的评测 高效离散语音、音频表征 离散语音、音频的可解释性 其他基于离散语音、音频表征的新型应用
| 2024. 02. 20 | 开始接受参赛者提交的结果 |
| 2024. 03. 02 | 论文摘要提交截止日期(和Interspeech2024一致) |
| 2024. 03. 09 | 论文修改截止日期(和Interspeech2024一致) |
| 2024. 03. 09 | 之后,我们仍然欢迎后续参赛者提交系统参与评估 |
更多详细信息请访问赛事官网:https://www.wavlab.org/activities/2024/Interspeech2024-Discrete-Speech-Unit-Challenge/
常烜恺(CMU)
史嘉彤(CMU)
Shinji Watanabe(CMU)
Yossi Adi (HUJI、Meta)
陈谐(SJTU)
金琴(RUC)
