文章来源于声纹圈,作者李蓝天
声纹识别,又称说话人识别,是根据语音信号中的声纹特征来识别话者身份的过程,也是一种重要的生物认证手段。历经几十年的研究,当前声纹识别系统已取得了令人满意的性能表现,并在安防、司法、金融、家居等诸多领域中完成部署,有着广阔的应用前景。

- 从不同的应用场景(Application)出发,衍生出不同的伪造行为(Fake action)。这些应用场景包括访问控制、监听和司法,伪造行为分为假冒攻击(Spoofing attack)和伪装欺骗(Disguise cheating)两大类。
- 进一步,根据伪造音频的生成模式(Production,来自人还是机器)和评价方法(Evaluation,通过听觉感知还是自动检测)的不同,对两大类伪造行为进一步细分,划分出不同的伪造技术手段(Technique),形成了从应用层到技术层的五层概念图(如下图所示)。
- 本工作更多是以应用为导向,对音频伪造进行宏观划分;因此面向读者可以是领域内的专家或技术人员,也可以是对领域感兴趣的学生或工程师。

