由中国计算机学会主办、CCF语音对话与听觉专委会承办、语音之家协办、华为终端有限公司独家合作的CCF先进音频技术竞赛将开启线上答疑,与大家进行交流互动,欢迎大家预约观看。
本次线上答疑活动,赛事组织方将通过线上会议的形式介绍此次CCF先进音频技术竞赛的赛事内容、赛程安排等相关情况,并与大家进行线上交流解答。诚邀广大师生踊跃参与,深入了解产业前沿动态,共同推动智能音频技术的交流与发展。
活动信息
活动时间:7月15日(周三)19:00-20:30
腾讯会议:通过腾讯会议入会,会议号:981-421-653

扫码直接进入会议👆
活动议程
开场致辞 — 19:00~19:05

嘉宾简介:凌震华,中国科学技术大学教授、博士生导师、信息科学技术学院副院长,语音及语言信息处理国家工程研究中心副主任,入选国家重大人才工程。主要从事语音信号处理、自然语言处理等方向的研究。主持多项国家自然科学基金、国家重点研发计划等科研项目,已发表论文200 余篇,累计被引1万余次,获国家科技进步奖一等奖、IEEE信号处理学会最佳青年作者论文奖等奖项,多次在国际语音语言技术评测中获得第一名。现任IEEE TASLP期刊编委、IEEE信号处理学会语音与语言处理技术委员会委员、中国计算机学会语音对话与听觉专委会秘书长。
CCF先进音频技术竞赛介绍 — 19:05~19:15

嘉宾简介:丛林林,2023年清华大学硕士毕业加入华为,作为华为终端BG音频算法专家,从事声场控制及AI算法研发,主导华为多款旗舰TWS耳机算法设计与交付,支撑构建产品领先的音频竞争力。
讲解概要:介绍华为终端业务以及音频部;本次大赛的创立背景,技术需求与挑战,以及对于学生的需要;最后介绍本次大赛的赛程安排、赛事特点、奖项设置等。
赛事一:音乐修复(讲解&QA) — 19:15~19:55

嘉宾简介:孔秋强,现任香港中文大学电子工程系助理教授。2020年于英国萨里大学获得博士学位,2015年和2012年于华南理工大学获得硕士和学士学位。曾于字节跳动任职研究科学家。研究方向包括语音、音乐、和一般音频信号处理。代表作包括基于弱标签的音频事件检测和分离、大规模音频分类、大规模音乐数据集等。2021年全球前2%高被引用研究员。曾获得2022 IEEE Young Best Paper Award及ISMIR 2022最佳论文奖。于音频领域顶级期刊和会议包括TASLP、TMM、ICASSP等发表多篇文章。音频领域内多个国内国际期刊和会议审稿人,并参与筹办了DCASE2018,LVA-ICA2018等多个国际学术会议。
讲解概要:数据内容,官方训练流程,模型推理和模型评估

嘉宾简介:刘飞,目前是中国科学技术大学语音实验室博士一年级研究生,师从凌震华老师。主要研究方向涵盖语音增强和语音编解码,以第一作者身份在IEEE TASLP、ICASSP、SLT等国际期刊与会议上发表多篇论文。
讲解概要:赛题一的数据构成和基线的评估效果
赛事二:主动降噪(讲解&QA) — 19:55~20:30

嘉宾简介:石栋元,西北工业大学人工智能学院教授,博士生导师,海外高层次人才。2020年获新加坡南洋理工大学(NTU)博士学位,并任新加坡国家智慧转换实验室高级研究员;2021年起担任南洋理工大学电子与电器学院研究助理教授。2024年加入西北工业大学航海学院智能声学与语音通信中心,主要从事主动噪声控制、自适应信号处理、高速数字系统设计及人工智能相关研究。现任《IEICE Transactions on Fundamentals of Electronics, Communications and Computer Sciences》等期刊副主编,亚太信息与信号处理协会(APSIPA)杰出讲师,以及ICASSP、Inter-Noise、ICSV等国际声学分会主席。曾获2018美国国家仪器研究奖,2020年南洋理工大学优秀博士生论文奖。
讲解概要:
- 基线模型:基于时域1D-CNN(TimeDomainANC)搭建,低延迟端到端主动降噪模型。采用因果膨胀卷积直接处理原始声音波形,无需频谱转换计算;同时内部结合了次级路径模拟,真实还原物理空间中的声波抵消过程。
- 基线框架:包含物理场景化数据加载,基于残差能量最小化的端到端训练流程,以及涵盖1/3倍频程精细化分析、高频反弹与设备算力的完整推理和评估流程。

