声浪
大语言模型合成语音在人工耳蜗使用者中的普通话感知研究取得突破:特定条件下可懂度接近自然语音
美东时间2026年06月30日,东南大学外国语学院博士生导师陈彧教授联合天津理工大学聋人工学院张句博士题为Perception of Synthesized Mandarin Speech Based on a Large-Scale La…
18 0 0
INTERSPEECH 2026|武汉大学电子信息学院智能音频与语音感知实验室13篇录用论文分享
分享武汉大学电子信息学院智能音频与语音感知实验室在Interspeech 2026中稿的13篇论文,论文涵盖语音增强、声源定位、声音事件检测、音频表征、音频大模型等多个研究方向。 ⏩一、多通道语音增强与鲁棒波束形成 Joint Learni…
19 0 0
让声音生成先“想清楚”再“说出来”:SemanticAudio
论文题目:SemanticAudio: Audio Generation and Editing in Semantic Space Demo:https://semanticaudio1.github.io/ 论文地址:https://a…
24 0 0
全球第一! 中国模型登顶榜首,首个可编辑AI语音来了
来源丨新智元 全球第一!中国AI语音ViiTorVoice首创「局部编辑」神技:配音错字告别重录,像改Word一样修语音。内附姆巴佩、哈兰德爆笑实测,快来见证! 中国AI,登顶全球第一! 最近,在全球语音权威评测榜单 Seed-TTS 上,…
20 0 0
【收藏】2025-2026中旬语音之家活动资源全汇总,一键直达学习!
👋 各位语音技术爱好者们,大家好! 2026年过半,语音之家陪伴大家走过了一段充实的学习之旅。从线上公开课到论文解读,从技术沙龙到行业分享,我们一起探索了语音技术的方方面面。 为了方便大家回顾学习、查漏补缺,我们把这期间的所有活动资源做了…
13 0 0
ICML 2026|CoCoEmo:面向人类式复杂情感表达的可组合、可控语音合成框架
Demo: https://wsssy.github.io/cocoemo_demo/ GitHub: https://github.com/wsssy/CoCoEmo Paper:
14 0 0
