直播回放
由CCF语音对话与听觉专委会 、中国人工智能产业发展联盟(AIIA)评估组 、北京希尔贝壳科技有限公司、语音之家(北京)科技有限公司共同主办的【语音之家】AI技术沙龙——声纹识别,将于2021年7月17号 9:30在线上直播进行。
沙龙简介



分享内容:声纹识别--等错误率背后的真实性能
摘要:近年来,随着深度学习技术的发展,声纹识别取得显著进步,在SITW, VoxSRC等测试集上已经获得了接近或低于3%的等错误率。然而,直到目前为止,声纹还没有像人脸一样得到广泛应用,研究人员对声纹的推广也持审慎态度。测试数据与实际性能的差异启发我们思考当前评测方法的合理性,并探讨声纹识别本身的基础困难。最近,我们发布了多场景声纹识别数据库CNCeleb,并基于该数据库对复杂真实场景下的性能进行了若干研究。研究结果表明,当前声纹识别技术可能还无法满足复杂场景下的性能要求,多场景、跨场景、场景泛化是未来声纹识别研究面临的一个主要困难。
嘉宾简介:王东,爱丁堡大学博士,清华大学副研究员,人工智能研究院听觉研究中心副主任,IEEE 高级会员,长期从事语音语言相关技术研究,在领域主要杂志和会议上发表论文150余篇,著有《人工智能》《机器学习导论》《语音识别基本法》等著作。

李 明
昆山杜克大学电子与计算机工程副教授

参会方式一:

扫码进入直播间观看
参会方式二:
点击下方链接进入直播间
https://wx.vzan.com/live/tvchat-1749577780?v=1626143958099#/

