语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
语音与音频学术速递[8.20]
每日语音速递每日语音速递
原创2 months ago
语音与音频学术速递[8.20]

今日论文合集:CS.SD语音与音频 | 共 5 篇。 本文经arXiv每日学术速递授权转载,微信公众号:arXiv_Daily [机构]信息由AI分析生成,可能存在错误,仅供参考,以论文实际显示为准 1. Geometric Iterati…

语音识别语音合成
156 0 0
语音与音频学术速递[8.19]
每日语音速递每日语音速递
原创2 months ago
语音与音频学术速递[8.19]

今日论文合集:CS.SD语音与音频 | 共 6 篇。 本文经arXiv每日学术速递授权转载,微信公众号:arXiv_Daily [机构]信息由AI分析生成,可能存在错误,仅供参考,以论文实际显示为准 1. A Multiplication-…

语音合成语音识别
188 0 0
语音与音频学术速递[8.18]
每日语音速递每日语音速递
原创2 months ago
语音与音频学术速递[8.18]

今日论文合集:CS.SD语音与音频 | 共 11 篇。 本文经arXiv每日学术速递授权转载,微信公众号:arXiv_Daily [机构]信息由AI分析生成,可能存在错误,仅供参考,以论文实际显示为准 1. Adding Voice Clo…

语音合成语音识别
158 0 0
方法、代码、模型已公开|OPSD 中文多方言 ASR:学会方言,不忘普通话
语音小管家语音小管家
转载2 months ago
方法、代码、模型已公开|OPSD 中文多方言 ASR:学会方言,不忘普通话

近年来,大规模语音识别模型在普通话识别上取得了显著进展,但中文方言识别仍然面临数据稀缺、地域差异大、声学与词汇分布复杂等挑战。一个常见做法是在预训练 ASR 模型上继续使用方言数据进行微调,虽然能够有效提升方言识别性能,却往往会导致模型原有…

语音识别
245 1 0
语音大模型推理加速:投机解码在 ASR 和 TTS 上的实践
语音小管家语音小管家
原创2 months ago
语音大模型推理加速:投机解码在 ASR 和 TTS 上的实践

投机解码(Speculative Decoding)可以在不改变模型输出的前提下加速自回归解码。本文介绍我们在 ASR 和 TTS 两类语音任务上的投机解码实践:ASR方向,Qwen2-Audio-7B和 Qwen3-Omni-30B 使用…

语音合成语音识别
349 1 2
Interspeech 2026丨统一梯度投影:面向多语言低资源语音识别的语言均衡持续学习
语音小管家语音小管家
转载2 months ago
Interspeech 2026丨统一梯度投影:面向多语言低资源语音识别的语言均衡持续学习

多语言语音识别在向低资源语言扩展时,通常需要按顺序适配多种新语言,如何在学习新语言的同时不损害已有语言的性能至关重要。近期,清华大学语音与音频技术实验室(SATLab)提出了一种融合语言均衡梯度投影与经验回放的统一持续学习方法(UGP),利…

语音识别
295 0 0
语音与音频学术速递[8.14]
每日语音速递每日语音速递
原创2 months ago
语音与音频学术速递[8.14]

今日论文合集:CS.SD语音与音频 | 共 4 篇。 本文经arXiv每日学术速递授权转载,微信公众号:arXiv_Daily [机构]信息由AI分析生成,可能存在错误,仅供参考,以论文实际显示为准 1. Alignment Drift i…

语音合成语音识别
238 0 0
让语音识别学会"听懂"纠正:Agentic ASR 框架与语义级评价
语音小管家语音小管家
转载2 months ago
让语音识别学会"听懂"纠正:Agentic ASR 框架与语义级评价

传统的自动语音识别系统主要遵循"单次通行(Single-pass)"的转录范式,将识别过程视为从音频到文字的开环映射任务。这种范式在交互逻辑上缺乏"反馈-修复"机制,在评价维度上无法区分关键语义错误与无关紧要的字面偏差。本文解读的论文 To…

语音识别
258 0 0
语音与音频学术速递[8.13]
每日语音速递每日语音速递
原创2 months ago
语音与音频学术速递[8.13]

今日论文合集:CS.SD语音与音频 | 共 9 篇。 本文经arXiv每日学术速递授权转载,微信公众号:arXiv_Daily [机构]信息由AI分析生成,可能存在错误,仅供参考,以论文实际显示为准 1. CookVoice: Unifie…

语音合成语音识别
147 0 0
语音与音频学术速递[8.12]
每日语音速递每日语音速递
原创2 months ago
语音与音频学术速递[8.12]

今日论文合集:CS.SD语音与音频 | 共 10 篇。 本文经arXiv每日学术速递授权转载,微信公众号:arXiv_Daily [机构]信息由AI分析生成,可能存在错误,仅供参考,以论文实际显示为准 1. Whisper-Aware LL…

语音合成语音识别
177 0 0
‹1234…129›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)7语音信号处理论文优选:Handling Background Noise in Neural Speech Generation8TIOBE 场景测试:汽车之家 汽车评测9TIOBE 场景测试:经济 金融 货币10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号