语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
NeurIPS 2025丨上海交通大学跨媒体语言智能实验室5篇录用论文分享
语音小管家语音小管家
转载a year ago
NeurIPS 2025丨上海交通大学跨媒体语言智能实验室5篇录用论文分享

NeurIPS,即神经信息处理系统大会(Conference on Neural Information Processing Systems),是由神经信息处理系统基金会(NeurIPS Foundation)主办的全球机器学习与人工智能…

语音合成语音识别
23 0 0
语音/音频处理学术速递[9.29]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[9.29]

语音识别语音合成
21 0 0
WenetSpeech-Chuan:多维标注大规模四川话语音语料库开源
语音小管家语音小管家
转载a year ago
WenetSpeech-Chuan:多维标注大规模四川话语音语料库开源

语音理解与生成的飞速发展离不开大规模高质量语音数据集的推动。其中,语音识别(ASR)和语音合成(TTS)被公认为最首要的任务。但对于拥有约 1.2亿 母语使用者的川渝方言而言,受限于标注资源匮乏,研究进展缓慢,ASR 与 TTS 的表现始终…

语音合成
22 0 0
语音/音频处理学术速递[9.28]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[9.28]

语音合成语音识别
19 0 0
语音/音频处理学术速递[9.26]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[9.26]

语音合成语音识别
23 0 0
语音/音频处理学术速递[9.25]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[9.25]

语音合成语音识别
17 0 0
语音/音频处理学术速递[9.23]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[9.23]

语音合成语音识别
22 0 0
语音/音频处理学术速递[9.22]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[9.22]

语音合成语音识别
20 0 0
小米开源首个原生端到端语音大模型 Xiaomi-MiMo-Audio
语音小管家语音小管家
转载a year ago
小米开源首个原生端到端语音大模型 Xiaomi-MiMo-Audio

刚刚,小米正式开源首个原生端到端语音模型Xiaomi-MiMo-Audio,该模型参数规模70亿,预训练数据达到超1亿小时,且在开源模型中的语音智能和音频理解基准测试中都实现了SOTA,在多项测试超越同参数量开源模型、谷歌Gemini-2.…

语音合成
44 0 0
VoxCPM:最新开源 TTS 模型!0.5B 的声音克隆神器。
语音小管家语音小管家
转载a year ago
VoxCPM:最新开源 TTS 模型!0.5B 的声音克隆神器。

来源丨THUHCSI人机语音交互实验室 本文介绍由清华大学人机语音交互实验室(THUHCSI)与面壁智能联合研发的VoxCPM,一款 0.5B 参数尺寸的中英双语语音生成基座模型 。 VoxCPM在合成语音的自然度、音色相似度及韵律表现力方…

语音合成
22 0 0
‹1…3435363738…111›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6TIOBE 场景测试:经济 金融 货币7详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)8语音信号处理论文优选:Handling Background Noise in Neural Speech Generation9TIOBE 场景测试:汽车之家 汽车评测10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号