语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
语音/音频处理学术速递[5.6]
每日语音速递每日语音速递
原创5 months ago
语音/音频处理学术速递[5.6]

语音合成语音识别
24 0 0
语音/音频处理学术速递[5.5]
每日语音速递每日语音速递
原创5 months ago
语音/音频处理学术速递[5.5]

语音合成语音识别
35 0 0
清华吴志勇团队联合小米提出 TTS-PRISM:12 维精细化中文语音合成诊断框架
语音小管家语音小管家
转载5 months ago
清华吴志勇团队联合小米提出 TTS-PRISM:12 维精细化中文语音合成诊断框架

标题:《TTS-PRISM: A Perceptual Reasoning and Interpretable Speech Model for Fine-Grained Diagnosis》 链接:https://arxiv.org/pd…

语音合成
16 0 0
语音/音频处理学术速递[4.30]
每日语音速递每日语音速递
原创5 months ago
语音/音频处理学术速递[4.30]

语音识别语音合成
27 0 0
语音/音频处理学术速递[4.29]
每日语音速递每日语音速递
原创5 months ago
语音/音频处理学术速递[4.29]

语音合成语音识别
24 0 0
小米MiMo-V2.5全量开源,再送 100 万亿 Token!
语音小管家语音小管家
转载5 months ago
小米MiMo-V2.5全量开源,再送 100 万亿 Token!

来源丨智东西 今天,小米正式开源 MiMo-V2.5 系列模型,采用MIT协议,允许商用推理部署与二次训练,无需额外授权。 ▲MiMo-V2.5-Pro在Hugging Face的开源页面截图 此前,该系列模型于4月23日开启公测,包括Mi…

语音合成语音识别
29 0 0
2.1K Star!视频创作者的核弹级开源工具来了!一句话即输出成片。
语音小管家语音小管家
转载5 months ago
2.1K Star!视频创作者的核弹级开源工具来了!一句话即输出成片。

FireRed-OpenStoryline将复杂的视频创作转化为自然直观的对话体验。兼顾易用性和企业级可靠性,让视频创作对初学者和创意爱好者都变得简单友好。 项目简介 FireRed-OpenStoryline是FireRedTeam团队开…

语音合成
28 0 0
语音/音频处理学术速递[4.27]
每日语音速递每日语音速递
原创5 months ago
语音/音频处理学术速递[4.27]

语音合成语音识别
26 0 0
MAGIC-TTS:首个实现字级内容与停顿毫秒级控制的语音合成系统
语音小管家语音小管家
原创6 months ago
MAGIC-TTS:首个实现字级内容与停顿毫秒级控制的语音合成系统

在今天的语音合成系统里,听起来自然已经不再稀缺,但哪里该慢一点、哪个字该拉长、哪个位置该停顿、停多久,依然很难真正交给用户来控制。 但这恰恰是很多真实应用场景在意的问题。 比如导航播报里,“前方路口左转”中的“左转”往往需要更清楚、更突出;…

语音合成
20 0 0
语音/音频处理学术速递[4.24]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.24]

语音合成语音识别
27 0 0
‹1…1213141516…111›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6TIOBE 场景测试:经济 金融 货币7详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)8TIOBE 场景测试:汽车之家 汽车评测9语音信号处理论文优选:Handling Background Noise in Neural Speech Generation10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号