语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
单并发,用的WeNetspeech离线大模型以及libtorch1.10,rescore和search都在500ms+,为什么这么慢呢?一般TLG有多大呀?语言模型大小会很影响速度的吧?
语音小管家语音小管家
问答4 years ago
单并发,用的WeNetspeech离线大模型以及libtorch1.10,rescore和search都在500ms+,为什么这么慢呢?一般TLG有多大呀?语言模型大小会很影响速度的吧?

Search很快,rescoring一般100~200ms,WeNetSpeech模型很大,这个时间和机器性能也有关系,语言模型大小不太影响速度。

96 0 0
实战1课程AIshell-1模型训练,到stage4 neural network training训练的时候报了这个runtime 的错,是什么原因?
语音小管家语音小管家
问答4 years ago
实战1课程AIshell-1模型训练,到stage4 neural network training训练的时候报了这个runtime 的错,是什么原因?

问:实战1课程AIshell-1模型训练,到stage4 neural network training训练的时候报了这个runtime 的错,是什么原因? 答:pytorch版本小于1.10.0

16 0 0
这里用conv2d做降采样的原理是什么?为什么用两个conv2d,第一次conv2d通道是从1->odim,第二次conv2d从odim->odim?第一次通道数为什么要改变?
语音小管家语音小管家
问答4 years ago
这里用conv2d做降采样的原理是什么?为什么用两个conv2d,第一次conv2d通道是从1->odim,第二次conv2d从odim->odim?第一次通道数为什么要改变?

问:这里用conv2d做降采样的原理是什么?为什么用两个conv2d,第一次conv2d通道是从1->odim,第二次conv2d从odim->odim?第一次通道数为什么要改变? 答:2d卷积用stride=2,就可以把原来的W*H的输入…

55 0 0
最后一个模型量化,在x86上也是有必要的吗?速度会提升多少?
语音小管家语音小管家
问答4 years ago
最后一个模型量化,在x86上也是有必要的吗?速度会提升多少?

x86略微改善,android提升两倍。具体RTF实验结果在WeNet第一版本论文中有。

29 0 0
sort是让一个batch内的音频按顺序排列吗?
语音小管家语音小管家
问答4 years ago
sort是让一个batch内的音频按顺序排列吗?

通过排序使batch中音频数据长度差距不大。

84 0 0
conf中shuffle和sort为什么不冲突,而且注解说sort size必须小于shuffle size
语音小管家语音小管家
问答4 years ago
conf中shuffle和sort为什么不冲突,而且注解说sort size必须小于shuffle size

目的不一样,sort目的是使一个batch中的wav数据长度一致。shuffle是打乱整个数据集中数据的顺序。

35 0 0
 目前如果用WeNet,如果要使用一台服务器支持100个并发,这样需要什么要配置才能满足要求?
语音小管家语音小管家
问答4 years ago
目前如果用WeNet,如果要使用一台服务器支持100个并发,这样需要什么要配置才能满足要求?

16c应该就能满足,在虚拟机上32c可以实现,实时内存3G左右,如果rtf 按 0.2 算的话,一核能搞定 5 并发,可以具体测一下 rtf。

53 0 0
一般这种websocket 如何做高并发,有没有好的解决方案呢?
语音小管家语音小管家
问答4 years ago
一般这种websocket 如何做高并发,有没有好的解决方案呢?

需要再包装一层上层服务,可以用nginx代理,nginx可以代理ws,后面部署多个ws server。

51 0 0
我们测试websocket server 在高并发连接情况下出现连接慢的情况,这个是同时100个ws连接下出现的。这个有什么好的解决办法吗?
语音小管家语音小管家
问答4 years ago
我们测试websocket server 在高并发连接情况下出现连接慢的情况,这个是同时100个ws连接下出现的。这个有什么好的解决办法吗?

问:我们测试websocket server 在高并发连接情况下出现连接慢的情况,这个是同时100个ws连接下出现的。这个有什么好的解决办法吗? 答:可以尝试一下grpc。

89 0 0
热词输出带上 context 的标志了,是不是通过参数可以控制?还是要改下代码,去掉?
语音小管家语音小管家
问答4 years ago
热词输出带上 context 的标志了,是不是通过参数可以控制?还是要改下代码,去掉?

可以看一下 decoder/context_graph.cc后续新版的热词不会更改识别结果,而是返回识别结果的同时,额外返回识别到的热词列表,可以关注一下。

44 0 0
‹1…56789…14›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6TIOBE 场景测试:汽车之家 汽车评测7详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)8TIOBE 场景测试:经济 金融 货币9语音信号处理论文优选:Handling Background Noise in Neural Speech Generation10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号