👋 各位语音技术爱好者们,大家好! 2026年过半,语音之家陪伴大家走过了一段充实的学习之旅。从线上公开课到论文解读,从技术沙龙到行业分享,我们一起探索了语音技术的方方面面。 为了方便大家回顾学习、查漏补缺,我们把这期间的所有活动资源做了…
声浪
【收藏】2025-2026中旬语音之家活动资源全汇总,一键直达学习!
14 0 0
ICML 2026|CoCoEmo:面向人类式复杂情感表达的可组合、可控语音合成框架
Demo: https://wsssy.github.io/cocoemo_demo/ GitHub: https://github.com/wsssy/CoCoEmo Paper:
15 0 0
CCF先进音频技术竞赛校园行热力续航,港中深、浙大站即将开启!
自第二届CCF先进音频技术竞赛启动以来,「走进校园」系列宣讲活动横跨东西、纵贯南北,走过全国11所高校与科研院所。截至目前,武汉大学、中国科学技术大学、上海交通大学、清华大学深圳国际研究生院、四川大学、清华大学、哈尔滨工程大学&哈尔滨工业大…
14 0 0
Interspeech2026|UniSinger:面向伴奏协同生成的统一歌曲生成与歌声转换
近年来,生成式AI的突破极大地推动了歌曲生成(Song Generation)和歌声转换(Singing Voice Conversion, SVC)技术的发展 。然而,在面对音乐创作中统一建模的需求时,现有方法依然面临两大任务长期相互孤立…
13 0 0
Fun-ASR-Flash 从“听清楚”走向“听明白”
以下文章来源于阿里语音AI 在标准普通话、清晰录音的条件下,语音识别主流模型的准确率早已相当高。现实中的语音很少是“标准”的。它可能是一口浓重的家乡方言,可能中外夹杂、不时蹦出小语种,也可能藏着需要结合上下文才能判断的同音词。当说话人换成方…
31 0 0
网易有道开源 14 语种零样本TTS:无需参考文本+跨语种无口音 +情感迁移+附子曰 4 整套生态
以下文章来源于一杯阔乐聊ai,以下文章来源于一杯阔乐聊ai 01、资源导航 项目主页:https://github.com/netease-youdao/Confucius4-TTS 在线 Demo:https://confucius4-t…
23 0 0
可控文本到语音的最新进展:从宏观风格到精细表达
AudioCC交我学 作为学术研究者与实践者的连接点,我们致力于打造一个专注于语音技术的学术交流平台——「AudioCC交我学」专栏。在这里,我们将以简洁、专业的视角,解读听觉认知与计算声学领域的前沿论文,分享技术创新与应用实践的最新动态。…
32 0 0
