语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
语音/音频处理学术速递[2.9]
每日语音速递每日语音速递
原创8 months ago
语音/音频处理学术速递[2.9]

语音合成语音识别
37 0 0
GPT-5.3上线Codex!OpenAI回应Claude新模型只用了15分钟
语音小管家语音小管家
转载8 months ago
GPT-5.3上线Codex!OpenAI回应Claude新模型只用了15分钟

来源丨量子位 火星撞地球,新模型大战! Claude Opus 4.6发布仅仅15分钟,OpenAI也甩出了自己最新最强编程模型—— GPT-5.3-Codex。 最直观的感受是,这个新模型终于有点美学品味了。 官方展示了两个Demo:一个…

大模型
24 0 0
ICASSP 2026|通义实验室13篇录用论文分享
语音小管家语音小管家
转载8 months ago
ICASSP 2026|通义实验室13篇录用论文分享

通义实验室语音团队提出一种基于心理学 PAD 模型的情感语音合成框架,支持用户在愉悦度(Pleasure)、唤醒度(Arousal)和支配度(Dominance)上灵活控制情感表达。无需依赖固定情感标签,就能自由组合出“温柔但坚定”“兴奋而…

语音识别语音合成
35 0 0
语音/音频处理学术速递[2.6]
每日语音速递每日语音速递
转载8 months ago
语音/音频处理学术速递[2.6]

语音合成语音识别
22 0 0
TASLP 2026 - 声纹密码易被攻击,CODA-OCC 可有效拦截伪装声音
语音小管家语音小管家
转载8 months ago
TASLP 2026 - 声纹密码易被攻击,CODA-OCC 可有效拦截伪装声音

想象这样一个场景:你使用声纹锁保护隐私,攻击者在旁边播放了一段看似普通的陌生人录音(比如一段新闻或别人的谈话)。人耳听不出异样,声纹锁却被“欺骗”并打开了——这就是物理信道(OTA)对抗攻击。 以往,空气中的噪音和回声是天然的屏障,会让这种…

语音鉴伪
26 0 0
ICASSP 2026|杭电智能语音课题组3篇录用论文分享
语音小管家语音小管家
转载8 months ago
ICASSP 2026|杭电智能语音课题组3篇录用论文分享

本期分享杭州电子科技大学智能语音课题组在信号处理领域顶级会议ICASSP 2026上录用的3篇论文,入选论文涵盖生成式语音增强、高保真神经音频压缩以及基于最优传输的无监督学习。作为IEEE主办的全球旗舰会议,ICASSP是语音与音频前沿技术…

语音增强
25 0 0
语音/音频处理学术速递[2.5]
每日语音速递每日语音速递
原创8 months ago
语音/音频处理学术速递[2.5]

语音合成语音识别
27 0 0
【交我学-24】IWSLT2025赛事视角下,同步语音翻译研究近况与未来展望
语音小管家语音小管家
转载8 months ago
【交我学-24】IWSLT2025赛事视角下,同步语音翻译研究近况与未来展望

AudioCC交我学 在全球化沟通日益频繁的今天,口语机器翻译(SLT)作为打破语言壁垒的核心技术,正朝着更实时、更高效、更贴合真实场景的方向发展。 IWSLT作为每年一度的国际口语机器翻译评测大赛,致力于推动口语翻译各领域发展。2025…

语音翻译
25 0 0
ICASSP 2026|上交大跨媒体语言智能实验室12篇录用论文分享(二)
语音小管家语音小管家
转载8 months ago
ICASSP 2026|上交大跨媒体语言智能实验室12篇录用论文分享(二)

近日,ICASSP 2026会议发出了审稿结果通知,上海交通大学跨媒体语言智能实验室共12篇论文被会议接收。我们将用两期推送介绍接收论文,本文是第二期。 07、Task Vector in TTS: Toward Emotionally E…

语音合成语音识别
21 0 0
Avignon&剑桥大学:自监督语音模型预训练的数据选择策略研究
语音小管家语音小管家
转载8 months ago
Avignon&剑桥大学:自监督语音模型预训练的数据选择策略研究

标题:A Study Of Data Selection Strategies For Pre-Training Self-Supervised Speech Models 链接:https://arxiv.org/pdf/2601.208…

语音模型
16 0 0
‹1…4647484950…479›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)7TIOBE 场景测试:经济 金融 货币8语音信号处理论文优选:Handling Background Noise in Neural Speech Generation9TIOBE 场景测试:汽车之家 汽车评测10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号