语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
Interspeech 2026 | 墨尔本大学 AIMS AI Lab 16篇录用论文分享
语音小管家语音小管家
转载4 months ago
Interspeech 2026 | 墨尔本大学 AIMS AI Lab 16篇录用论文分享

以下内容来源:AIMS AI LAB 近日,AIMS AI Lab 共有16 篇论文被国际语音技术领域旗舰会议 Interspeech 2026 接收,覆盖多个前沿方向,包括语音大模型推理和后训练、情感计算、低资源语言、语音应用以及神经元群…

语音合成语音识别
16 0 0
语音与音频学术速递[6.25]
每日语音速递每日语音速递
原创4 months ago
语音与音频学术速递[6.25]

语音合成语音识别
16 0 0
语音转换还要“偷看”未来?Zero-VC 实现真正零延迟:说话人匿名化一招破局
语音小管家语音小管家
转载4 months ago
语音转换还要“偷看”未来?Zero-VC 实现真正零延迟:说话人匿名化一招破局

实时语音转换(Streaming Voice Conversion, VC)是虚拟人、实时变声、隐私通话等应用的核心技术。它的目标很明确:在极低延迟下,将源说话人的音色转换为目标说话人,同时保留内容和韵律。 然而,现有的流式零样本 VC 方…

语音合成
26 0 0
语音与音频学术速递[6.24]
每日语音速递每日语音速递
原创4 months ago
语音与音频学术速递[6.24]

语音合成语音识别
19 0 0
语音与音频学术速递[6.23]
每日语音速递每日语音速递
原创4 months ago
语音与音频学术速递[6.23]

语音识别语音合成
20 0 0
看一眼就够了!MeMo:让 模型 在「看不见」时,依然能「听得准」
语音小管家语音小管家
原创4 months ago
看一眼就够了!MeMo:让 模型 在「看不见」时,依然能「听得准」

当视觉信息丢失、模糊或被遮挡,模型 还能否精准地从嘈杂人声中提取出目标说话人的声音?本文提出的MeMo 框架,借鉴人类大脑的「注意力动量」机制,让模型像人一样——只要看一眼,就能持续聚焦。 在视觉受损场景下,MeMo 取得了约27% 的相对…

语音合成
24 0 0
语音与音频学术速递[6.19]
每日语音速递每日语音速递
原创4 months ago
语音与音频学术速递[6.19]

语音合成语音识别
29 0 0
Interspeech 2026丨上交大跨媒体语言智能实验室7篇录用论文分享
语音小管家语音小管家
转载4 months ago
Interspeech 2026丨上交大跨媒体语言智能实验室7篇录用论文分享

近日,Interspeech 2026 公布了论文录用结果,上海交通大学跨媒体语言智能实验室共7篇论文被会议接收。Interspeech 是由国际语音通信协会(ISCA)组织的语音研究领域的顶级会议之一,是全球最大的综合性语音信号处理领域的…

语音合成语音识别
23 0 0
ACL 2026丨上交大跨媒体语言智能实验室5篇录用论文分享
语音小管家语音小管家
转载4 months ago
ACL 2026丨上交大跨媒体语言智能实验室5篇录用论文分享

近日,第 64 届国际计算语言学年会(Annual Meeting of the Association for Computational Linguistics,ACL)公布了论文录用结果,上海交通大学跨媒体语言智能实验室共5篇论文被会…

语音合成语音识别
18 0 0
ACL 2026 | 一种以数据为中心的可泛化语音深度伪造检测方法
语音小管家语音小管家
原创4 months ago
ACL 2026 | 一种以数据为中心的可泛化语音深度伪造检测方法

ACL (Annual Meeting of the Association for Computational Linguistics) 是计算语言学与自然语言处理(NLP)领域最具影响力的国际学术会议之一,每年汇聚全球顶尖学者、研究机构…

语音深度伪造检测
40 0 0
‹1…2021222324…479›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6TIOBE 场景测试:经济 金融 货币7TIOBE 场景测试:汽车之家 汽车评测8详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)9语音信号处理论文优选:Handling Background Noise in Neural Speech Generation10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号