近日,由西北工业大学音频语音与语言处理研究组、天津大学认知计算与应用天津市重点实验室、 南洋理工大学、北京希尔贝壳科技有限公司、WeNet 开源社区在第十三届中文口语语言处理国际会议(ISCSLP 2022)上共同发起的智能座舱语音识别挑战赛(Intelligent Cockpit Speech Recognition Challenge, ICSRC)已正式开启,欢迎产学研的同仁报名参加。
ISCSLP 2022 官网:https://www.iscslp2022.org

Aishell (SLR33), 178小时安静普通话数据; Free ST Chinese Mandarin Corpus (SLR38): 102600条电话录制数据; Primewords Chinese Corpus Set 1 (SLR47):100小时智能手机录制数据; aidatatang_200zh (SLR62): 200小时600说话人数据; MAGICDATA Mandarin Chinese Read Speech Corpus (SLR68): 755小时朗读数据; MAGICDATA Mandarin Chinese Conversational Speech Corpus (SLR123): 180小时对话数据; MUSAN (SLR17), 噪声数据; Room Impulse Response and Noise Database (SLR28), 房间冲激响应和噪声数据。
Track I (模型受限赛道): 模型参数量不得超过15M,如果系统包含FST则FST文件大小不得超过25M。 Track II (模型不受限赛道): 对模型参数量和系统大小不做限制。

分别代表插入错误,替换错误和删除错误的数量,
代表字符总数。竞赛论文出版
竞赛排名靠前的队伍将受邀提交和方案相关的论文,经过组委会审稿后,依据成绩、方案贡献和论文质量,录用至 ISCSLP 2022 国际会议,收录论文集出版,EI检索,同时在 ISCSLP 2022 会议的竞赛 Session 上宣读论文。
- 2022年9月3日 : 发布校验集
- 2022年9月10日: 报名截止
- 2022年9月11日: 发布基线系统和Leaderboard.
- 2022年9月28日 : 发布测试集
- 2022年9月30日 : 提交最终结果截止
- 2022年10月8日 : 公布竞赛结果
- 2022年10月14日 : 优秀队伍邀请论文提交截止
- 2022年10月24日 : 论文最终版提交截止
- 2022年12月11-14日 : ISCSLP会议与竞赛Session与颁奖
允许对原始训练数据进行数据增广,包括但不限于加噪加混响,变速变调,但参赛者只能使用允许的噪声集合 (SLR17,SLR28) 进行增广; 任何形式的对测试集的利用都是不允许的,包括但不限于使用测试集微调模型; 多系统融合可以用于 track II 但不可以用于 track I; 如果两个系统 CER 相同,计算复杂度更低的模型位次更高; 训练对齐模型必须使用允许的训练集列表中的数据; 语言模型的训练数据只可使用训练集列表中数据的抄本,不能使用额外的文本数据; 本比赛最终解释权归主办方所有。
邮件主题: [ ISCSLP 2022 ICSRC Challenge Registration] –队伍名 - 参加赛道; 内容需包含队伍名,所属机构,参加赛道,队长和队员的联系方式; 报名邮件务必使用学校、研究机构或者公司的官方邮箱发出,公共服务邮箱(例如163com, qq.com, gmail.com)的注册报名不予接受。

