
特殊议题申请指南
NCMMSC2021会议期间设置特殊议题,主要范围包括语音前沿技术和相关交叉研究方向,为了提高申请的质量,特殊议题申请包含以下的内容:
特殊议题组织者的信息(单位和邮箱)和简介,每个特殊议题组织者可以不限于一位;
特殊议题的名称;
特殊议题的简介(包括议题设置的目的和意义等);
至少4篇特邀论文的作者、标题和摘要(可暂定);
特殊议题申请者需填写以上内容并提交给大会特殊议题主席讨论确定。
NCMMSC2021特殊议题主席

特殊议题—
语音是人类语言交流最基本和最重要的形式,语音能力的习得、发展和变化规律研究有着重要的理论和实践意义。儿童的语音发展、跨语言的二语语音习得、语障儿童的语音能力培养、语音病理与康复等等需求都给语音学及语音技术研究提出了众多新课题。
另外,随着大数据、机器学习和深度神经网络的发展,语音技术在语音合成、语音识别、语音分析等领域有长足进步,如何利用语音技术研究或解决人类语音能力获得或发展中的痛点问题,逐渐成为研究的热点。
为此,第16届全国人机语音通信大会特设“语音能力与智能技术”特殊议题,旨在促进相关领域同仁同台交流学术及应用进展经验,探讨未来发展趋势。欢迎国内外同行踊跃投稿,相关主题包括并不限于:
语音习得基础理论研究
语音学习或发展任务中的数据库建设和数据标注研究
音段、韵律偏误检测研究
发音逆分析研究
正音反馈技术研究
发音可视化研究
智能语音学习技术或系统
智能语音产业化研究等
如有意莅临交流指导,请于近期将作者信息、论文题目和摘要(可暂定)发给特殊议题组织者,联系信息如下:
特殊议题二
近年来,随着应用场景的日益复杂,多人交互场景下(如家居场景的CHiME-6评测和会议场景的AISHELL-4开源数据集等)的智能语音处理技术受到了越来越多的关注。但是这些场景下存在的语音口语化、环境噪声、房间混响和人声重叠等诸多问题,带来了很高的技术挑战。
因此,第16届全国人机语音通信大会设立了“多人交互场景下的智能语音处理”的特殊议题,希望学术界和工业界的同行能够踊跃投稿,交流分享相关研究和应用成果促进本领域的技术发展,相关主题包括但不限于:
说话人识别与分割
声源定位与波束成形
单麦克风或多麦克风增强和分离
鲁棒性的特征和特征变换
鲁棒性的声学和语言建模
传统或端到端的鲁棒语音识别
鲁棒性的说话人和语言识别
跨环境或跨数据集性能分析
环境背景噪声建模
基于多模态信号的语音相关应用
特殊议题组织者:
谢磊 (lxie@nwpu.edu.cn),西北工业大学教授,研究领域包括音频语音与语言处理、多媒体技术、机器学习、人机交互等。
杜俊 (jundu@ustc.edu.cn),中国科学技术大学副教授,主要从事语音信号处理和模式识别相关研究。
卜辉 (buhui@aishelldata.com),希尔贝壳CEO,主要从事前沿语音与语言数据库研究及推动语音领域相关的开源项目
特殊议题三
一般声学信号理解,指对于非语音、非音乐信号的内容理解和信息处理。一般声学信号处理的兴起,以2013年第一届声学场景和事件检测及分类数据挑战赛(Challenge on Detection and Classification of Acoustic Scenes and Events, DCASE)的组织举办为标志性事件。
随着DCASE数据挑战赛的连续举办,越来越多的国内外顶级高校组织、权威科研机构等参与到比赛中来,使得相关技术得到了长足的进步。我国科研院校在DCASE数据挑战赛连年取得佳绩,标志着我国在一般声学信号领域的研究取得了长足的进步。
为了更好地展示我国在一般声学信号领域的最新发展,第16届全国人机语音通信大会设立了“一般声学信号理解”的特殊议题,希望学术界和工业界的同行能够踊跃投稿,交流分享相关研究和应用成果促进本领域的技术发展,相关主题包括但不限于:
声学场景分类
异常声音检测(如机器声音、心跳声音等)
声音事件的定位和检测
家庭环境中的声音事件检测和分离
基于时空上下文的城市声音标记
小样本生物声学事件检测
自动音频字幕转写
特殊议题组织者:
邵曦 (shaoxi@njupt.edu.cn),南京邮电大学教授,研究领域包括音频信号分析与检索、多媒体跨模态分析技术等。
李圣辰 (shengchen.li@xjtlu.edu.cn),西交利物浦大学助理教授,主要从事音频信号处理和模式识别相关研究
特殊议题四
因此,第16届全国人机语音通信大会设立了“真实场景下的阿尔茨海默综合症识别挑战”的特殊议题,希望学术界和工业界的同行能够踊跃投稿,交流分享相关研究和应用成果促进本领域的技术发展,相关主题包括但不限于:
阿尔茨海默综合症语音的数据库建设
鲁棒性的病理语音特征
端到端的AD分类系统
基于无监督预训练的AD分类
跨场景或跨任务的性能分析
鲁棒性的声学特征及语言建模
基于小数据量的迁移学习
自适应AD模型建构
基于自动语音识别的相关应用
特殊议题组织者:
朱祖德 (zhuzude@163.com),江苏师范大学教授,研究领域为语言及其障碍机制。
张卫强 (wqzhang@tsinghua.edu.cn),清华大学语音与音频技术实验室,主要研究领域包含语音与音频信号处理、音乐与声学信号处理、数字信号处理等。
马勇 (may@jsnu.edu.cn),江苏师范大学,主要从事语音与音频信号处理,模式识别研究。
郝玉峰,海天瑞声公司副总经理、首席科学家。
王晓怡,南京智精灵教育科技有限公司总经理。
| 特殊议题投稿截止日期 | 2021年8月31日 |
| 大会日期 | 2021年10月15-18日 |
