语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
博彦科技 | 招聘语音算法工程师(北京)
语音小管家语音小管家
转载2 years ago
博彦科技 | 招聘语音算法工程师(北京)

博彦科技 博彦科技(深交所上市公司, 股票代码002649)是亚太领先的全方位IT服务及行业解决方案提供商,具备全球范围内的交付能力。博彦科技创立于1995年,员工20000多人, 是中国IT行业的先行者和领军企业,拥有完善、成熟的管理和开…

语音算法语音识别
31 0 0
语音/音频处理学术速递[5.6]
每日语音速递每日语音速递
原创2 years ago
语音/音频处理学术速递[5.6]

今日论文合集:cs.SD语音8篇,eess.AS音频处理9篇。 本文经arXiv每日学术速递授权转载 cs.SD语音

语音合成语音识别
22 0 0
语音/音频处理学术速递[5.3]
每日语音速递每日语音速递
原创2 years ago
语音/音频处理学术速递[5.3]

今日论文合集:cs.SD语音6篇,eess.AS音频处理6篇。 本文经arXiv每日学术速递授权转载 cs.SD语音

语音合成语音识别
26 0 0
语音/音频处理学术速递[5.2]
每日语音速递每日语音速递
原创2 years ago
语音/音频处理学术速递[5.2]

今日论文合集:cs.SD语音8篇,eess.AS音频处理8篇。 本文经arXiv每日学术速递授权转载 cs.SD语音

语音合成语音识别
32 0 0
语音/音频处理学术速递[4.30]
每日语音速递每日语音速递
原创2 years ago
语音/音频处理学术速递[4.30]

今日论文合集:cs.SD语音12篇,eess.AS音频处理13篇。 本文经arXiv每日学术速递授权转载 cs.SD语音

语音合成语音识别
24 0 0
IEEE TASLP | 基于文本-语音跨模态表征的对话语音识别
西工大音频语音与语言处理研究组西工大音频语音与语言处理研究组
原创2 years ago
IEEE TASLP | 基于文本-语音跨模态表征的对话语音识别

随着语音技术的不断发展,在诸如会议转录和语音助手等各种应用中,大家对对话语音接口的需求出现了迅速增长。我们需要在现有语音系统的基础上,进一步拓展其对对话语音的识别能力。对话语音有其独有的特征,如角色偏好(role preferences)和…

语音识别
90 0 0
语音/音频处理学术速递[4.29]
每日语音速递每日语音速递
原创2 years ago
语音/音频处理学术速递[4.29]

今日论文合集:cs.SD语音9篇,eess.AS音频处理8篇。 本文经arXiv每日学术速递授权转载 cs.SD语音

语音合成语音识别
43 0 0
对话Kaldi之父、小米首席语音科学家Daniel Povey:开源环境比金钱和荣誉更吸引我
语音小管家语音小管家
转载2 years ago
对话Kaldi之父、小米首席语音科学家Daniel Povey:开源环境比金钱和荣誉更吸引我

作者 | 王轶群 责编 | 唐小引 出品丨AI 科技大本营(ID:rgznai100) 北京初春,一个微风拂面的午后,《AGI 技术 50 人》栏目团队专程去小米总部拜访了Daniel,与他面对面聊了聊加入小米的这四年半,以及他在中国的科研…

语音识别
82 0 0
语音/音频处理学术速递[4.25]
每日语音速递每日语音速递
原创2 years ago
语音/音频处理学术速递[4.25]

今日论文合集:cs.SD语音15篇,eess.AS音频处理13篇。 本文经arXiv每日学术速递授权转载 cs.SD语音

语音合成语音识别
41 0 0
谷歌发布基于声学建模的无限虚拟房间增强现实鲁棒语音识别技术
21dB声学人21dB声学人
转载2 years ago
谷歌发布基于声学建模的无限虚拟房间增强现实鲁棒语音识别技术

声学室模拟允许在AR眼镜上以最少的真实数据进行训练,用于开发鲁棒的语音识别声音分离模型。 随着增强现实(AR)技术的强大和广泛应用,它能应用到各种日常情境中。我们对AR技术的潜能感到兴奋,并持续不断地开发和测试新技术与体验。其中一个研究方向…

语音识别
42 0 0
‹1…7576777879…129›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6语音信号处理论文优选:Handling Background Noise in Neural Speech Generation7TIOBE 场景测试:经济 金融 货币8TIOBE 场景测试:汽车之家 汽车评测9详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号