2022年9月27日,由CCF语音对话与听觉专委会 、中国人工智能产业发展联盟(AIIA)评估组、国音智能、语音之家、北京希尔贝壳科技有限公司共同主办的【语音之家】AI产业沙龙—语音技术在国音智能的应用在线上成功举办。

下面是本次沙龙的回顾:

许敏强

作为声纹识别比赛 VoxSRC2021(The Third VoxCeleb Speaker Recognition Challenge) 和 FFSVC2022(Far-field Speaker Verification Challenge 2022)两场比赛的冠军团队,本报告分享了针对两场比赛的方案设计和系统描述,展示了声纹识别领域的最新技术和成果。


郑渝

介绍了基于深度学习的声纹识别技术的基础技术框架,并对其原理进行剖析。同时,结合深度学习的前沿进展,探索其在声纹识别算法中的效果优化。


郝瀚

本主题介绍了国音智能语音识别技术框架,并从会议系统的场景出发介绍整体技术和优化细节,包括远场识别优化,热词速度优化等。


沈阳

本主题介绍了预训练模型在工业界的落地;低标注资源条件下如何打造语音识别系统;基于预训练模型的小语种语音识别思路、面临的困难以及对未来的展望。