语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
谷歌研究者发布Magenta RealTime:开源实时音乐生成框架
语音小管家语音小管家
转载a year ago
谷歌研究者发布Magenta RealTime:开源实时音乐生成框架

谷歌的Magenta团队推出了Magenta RealTime(Magenta RT),这是一种开放权重的实时音乐生成模型,为生成式音频带来了前所未有的交互性。Magenta RT根据Apache 2.0许可证发布,可在GitHub和Hug…

语音合成
13 0 0
开源TTS离线工具!浏览器本地运行,仅300MB模型大小!
语音小管家语音小管家
转载a year ago
开源TTS离线工具!浏览器本地运行,仅300MB模型大小!

来源丨图灵AI云 Streaming-Kokoro是一款基于网络的文本转语音应用程序,利用Kokoro-82M模型在浏览器中生成高质量的语音音频。 它完全在浏览器中运行,无需任何服务器端处理或 API 调用,是一个真正开源、隐私保护、零服务…

语音合成
18 0 0
语音/音频处理学术速递[6.25]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[6.25]

语音合成语音识别
22 0 0
语音/音频处理学术速递[6.23]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[6.23]

语音合成语音识别
22 0 0
腾讯AI Lab开源音乐生成大模型SongGeneration
语音小管家语音小管家
转载a year ago
腾讯AI Lab开源音乐生成大模型SongGeneration

来源丨机器之心 6 月 16 日,腾讯 AI Lab 推出并开源 SongGeneration 音乐生成大模型。 SongGeneration主要解决音乐 AIGC 中音质、音乐性与生成速度这三大共性难题,基于 LLM-DiT 的融合架构,…

语音合成
33 0 0
语音/音频处理学术速递[6.18]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[6.18]

语音合成语音识别
15 0 0
语音/音频处理学术速递[6.17]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[6.17]

语音合成语音识别
13 0 0
21.7K 标星的开源TTS!FishAudio开源情感语音核弹:200万小时炼成“声优AI”!
语音小管家语音小管家
转载a year ago
21.7K 标星的开源TTS!FishAudio开源情感语音核弹:200万小时炼成“声优AI”!

在 AI 语音模型领域,不论开源还是闭源模型,能在全球排上前十的屈指可数,而 FishAudio 团队语音模型就在其列,每每有新模型上线,总能排进TTS-Arena TOP3之内。 近期,Fish Audio 推出了新一代的 TTS 语音模…

大模型语音合成
18 0 0
语音/音频处理学术速递[6.16]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[6.16]

语音合成语音识别
12 0 0
语音/音频处理学术速递[6.10]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[6.10]

语音识别语音合成
32 0 0
‹1…4344454647…111›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)7TIOBE 场景测试:经济 金融 货币8语音信号处理论文优选:Handling Background Noise in Neural Speech Generation9TIOBE 场景测试:汽车之家 汽车评测10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号