2022年1月14日,由厦门大学、清华大学、海天瑞声、西北工业大学及昆山杜克大学联合主办,中国计算机学会语音对话与听觉专委会、中文信息学会协办的第六届“东方语种识别竞赛”(OLR2021)研讨会在线上成功召开。研讨会全程英文交流,由清华大学王东老师主持。在研讨会上,获奖队伍分享了各自竞赛系统的设计和改进经验,参会人员针对语种和语音识别的技术难点进行了一场酣畅淋漓的交流!

14:30王东老师宣布研讨会开始,并对“东方语种识别竞赛”的发展和定位进行了简单介绍。

随后,洪青阳老师对本届竞赛进行了总结,介绍了本届竞赛的筹备情况,参赛队伍普遍使用的技术,比赛最终排名等内容。其中语种识别技术重点是采用ASR Encoder,然后迁移到语种模型,加上pooling层和语种分类层,再用语种数据进行finetune,优秀队伍的结果表明,这种方案可极大提升语种识别的性能,冠军队伍把EER从基线系统的8.977%降到0.2708%。而多语种语音识别比较有效的是采用LID判别语种类型+单语种语音识别(Hybrid或E2E架构),然后与E2E多语种语音识别结果融合,融合工具普遍采用ROVER;有部分队伍还加入了针对单语种的语言模型。本次竞赛结果表明,语种识别和多语种语音识别具有很强的互补性,两者之间如何进一步结合,非常值得深入研究。

在海天瑞声的市场部总监张楉林对OLR赛事的数据集进行了简单介绍后,来自昆山杜克大学的李明老师宣布了任务一与任务二获奖的队伍,来自西北工业大学的张晓雷老师宣布了任务三与任务四获奖的队伍。本届比赛最终排行榜如下所示。


紧接着,8支获奖队伍依次进行了技术分享。
第一支分享的队伍是来自蚂蚁集团的X-Voice,他们夺取了语种识别赛道的两个任务的第一名,分别是语种识别受限任务的第一名,语种识别开放任务的第一名。









