声浪
INTERSPEECH 2025丨智能语音信息处理团队15篇录用论文分享
分享语音及语言信息处理国家工程研究中心智能语音信息处理团队中稿的15篇论文,论文方向涵盖语音识别、语音合成、语音编码、话者识别、语音增强、情感识别、声音事件检测等,各接收论文简介见后文。 01、Improving Noise Robustn…
33 0 0
【活动预告】INTERSPEECH 2025 论文预讲会启动
INTERSPEECH 2025 论文预讲会由CCF语音对话与听觉专委会、语音之家主办,旨在为学者们提供更多的交流机会,更方便、快捷地了解领域前沿。活动将邀请 INTERSPEECH 2025 录用论文的作者进行报告交流。 INTERSPE…
16 0 0
INTERSPEECH 2025丨THUHCSI 实验室8篇录用论文分享
分享清华大学人机语音交互实验室(THUHCSI)中稿的8篇论文,内容涉及智能语音交互领域的诸多研究方向,包括语音大模型泛化能力、自回归语音合成加速、文本驱动的可控语音转换、歌声转换、构音障碍语音重建、音频水印及其对抗防御等。论文工作将学术科…
29 0 0
Interspeech2025丨NPU-ASLP实验室11篇录用论文分享
Interspeech 是由国际语音通讯协会组织的语音处理领域旗舰国际会议,作为全球最大的综合性语音处理领域的科技盛会,历届Interspeech会议都备受全球学术界和工业界的广泛关注。第26届Interspeech大会将于2025年8月1…
34 0 0
音效设计进入真AI时代:Waves IlluGen AI文本转音引擎
来源丨AI音频时代 Waves Audio 宣布推出AI驱动的生成式声音生成软件 IlluGen,这是一款新的桌面文本到声音生成器应用程序,可以从文本提示中创建独特的单音、音乐采样以及音效。 人工智能(AI)和订阅制模式是两个容易引发声音人…
17 0 0
