语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
180万小时数据训练,VoxCPM 1.5开源:支持全量微调,精准复刻真人声
语音小管家语音小管家
转载10 months ago
180万小时数据训练,VoxCPM 1.5开源:支持全量微调,精准复刻真人声

来源丨PaperWeekly 180 万小时、44k 高保真、支持全量微调——刚刚开源的 VoxCPM 1.5,技术细节全解密。 最近,面壁技术团队发布了 VoxCPM 1.5 版本,在持续优化开发者开发体验的同时,也带来了多项核心能力升级…

语音合成
21 0 0
语音增强(语音消噪)现在已经发展到什么程度了?
语音小管家语音小管家
原创10 months ago
语音增强(语音消噪)现在已经发展到什么程度了?

本文由知乎作者Oliver投稿,采用第一人称视角撰写 语音增强技术已经发展了好多年了,但是目前各说各的好或者是技术保密。那么现在语音增强技术到底发展到一种什么程度了呢?未来的趋向又在什么地方? 2022年入职后,在mentor的指导下我开始…

语音增强
40 0 0
语音/音频处理学术速递[12.12]
每日语音速递每日语音速递
原创10 months ago
语音/音频处理学术速递[12.12]

语音识别语音合成
15 0 0
GLM-TTS 发布并开源,字错误率和情感表达实现开源 SOTA
语音小管家语音小管家
原创10 months ago
GLM-TTS 发布并开源,字错误率和情感表达实现开源 SOTA

近日智谱正式发布工业级语音合成系统 GLM-TTS,并在 Hugging Face 和 ModelScope 上开放模型权重。 基于在数据筛选、基础模型结构、精品音色监督微调(SFT)范式和强化学习(RL)范式等多方面创新,GLM-TTS…

语音合成
31 0 0
ASRU 2025 | REF-VC:基于扩散模型的鲁棒、快速且富有表现力的零样本语音转换
语音小管家语音小管家
转载10 months ago
ASRU 2025 | REF-VC:基于扩散模型的鲁棒、快速且富有表现力的零样本语音转换

语音转换(Voice Conversion, VC)旨在在不改变语言内容的情况下,将源说话人的语音转换为目标说话人的语音,广泛应用于电影配音、虚拟人、语音聊天等场景。然而在真实应用场景中,VC 系统面临两大挑战。 环境噪声:用户录音往往嘈杂…

语音转换
22 0 0
语音安全方向科研助理招聘丨昆山杜克大学苗晓晓老师招聘启事
语音小管家语音小管家
原创10 months ago
语音安全方向科研助理招聘丨昆山杜克大学苗晓晓老师招聘启事

老师信息 苗晓晓,昆山杜克大学计算机科学系助理教授,研究方向包括语音安全与智能语音处理。她于2021 年获得中国科学院大学/中国科学院声学研究所信号与信息处理博士学位,并于 2021 年至 2023 年在日本国立信息学研究所(NII)从事博…

69 0 0
语音/音频处理学术速递[12.11]
每日语音速递每日语音速递
原创10 months ago
语音/音频处理学术速递[12.11]

语音合成语音识别
20 0 0
【交我学-19】从“听声音”到“读脑电”:语音模型在EEG信号处理中的运用
语音小管家语音小管家
转载10 months ago
【交我学-19】从“听声音”到“读脑电”:语音模型在EEG信号处理中的运用

大家好,欢迎来到「AudioCC交我学」专栏! 作为学术研究者与实践者的连接点,我们致力于打造一个专注于语音技术的学术交流平台——「AudioCC交我学」专栏。在这里,我们将以简洁、专业的视角,解读听觉认知与计算声学领域的前沿论文,分享技术…

语音模型
19 0 0
ASRU 2025 | SEF-MK: 通过多K-Means量化实现“去说话人特征嵌入”的语音匿名化
语音小管家语音小管家
原创10 months ago
ASRU 2025 | SEF-MK: 通过多K-Means量化实现“去说话人特征嵌入”的语音匿名化

语音匿名化(Voice Anonymization)旨在在保留语义和情感信息的同时去除说话人的身份特征。现有基于深度学习的主流方法通常依赖显式说话人嵌入模型(Speaker Embedding Model)来提取和替换说话人特征,但这类方法…

语音匿名化
23 0 0
EchoFree—超轻量神经声学回声消除模型
语音小管家语音小管家
转载10 months ago
EchoFree—超轻量神经声学回声消除模型

声学回声消除(Acoustic Echo Cancellation, AEC) 作为语音通信系统的核心预处理模块,其核心任务是从麦克风采集信号中实时分离近端语音(near-end speech)与远端回声(far-end echo)。该技术…

回声消除
21 0 0
‹1…6061626364…479›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6语音信号处理论文优选:Handling Background Noise in Neural Speech Generation7详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)8TIOBE 场景测试:经济 金融 货币9TIOBE 场景测试:汽车之家 汽车评测10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号