WenetSpeech 家族发展史,一场前赴后继的饕餮盛宴
转载a year ago
WenetSpeech 家族发展史,一场前赴后继的饕餮盛宴

WenetSpeech 家族就像是一场前赴后继的饕餮盛宴。前赴后继是指 WeNet 社区的小伙伴们在数据的投入上前赴后继,不断探索新的边界,你方唱罢我登场;而饕餮盛宴,不是一道菜,而是源源不断的菜品,是社区给开发者、公司、研究人员不断的献礼…

45 0 0
迈向语音大模型的平权之路
原创2 years ago
迈向语音大模型的平权之路

什么样的事情最有价值?难且正确的事情。把 1B 级别的大模型优化到和 200M级别模型相同水平的 RTF 同时 WER 维持代差,难道不是一件该令人亢奋的事情吗? --向前看,别回头 在两个月前的年度总结中,WeNet 社区已经开始向着更“…

111 0 0
上海声通团队在WeNet中开源Branchformer
转载3 years ago
上海声通团队在WeNet中开源Branchformer

上海声通信息科技股份有限公司作为交互式人工智能市场的领导者,具有极强的技术优势和突出的产品特点。公司基于自研的融合通信及人工智能两项核心技术,打造了丰富的、高度标准化的产品模块,为客户提供高效、稳定的产品体验。公司主要的业务场景为智慧城市、…

264 0 0
58同城AI Lab在WeNet中开源Efficient Conformer模型
转载4 years ago
58同城AI Lab在WeNet中开源Efficient Conformer模型

目 录 1.模型介绍 2.模型实现 3.流式推理 4.实验结果 2022年8月,58同城TEG-AI Lab语音技术团队完成了WeNet端到端语音识别的大规模落地,替换了此前基于Kaldi的系统,并针对业务需求对识别效果和推理速度展开优化,…

609 0 0
NVIDIA 在 WeNet 中开源 Noisy Student Training 方案
转载4 years ago
NVIDIA 在 WeNet 中开源 Noisy Student Training 方案

为了改进 Noisy Student Training 在非目标领域 ASR 上的性能,英伟达提出新型数据筛选方法 LM Filter。其利用不同解码方式的识别文本之间的差异来作为数据筛选条件,是一个完全无监督的筛选过程。在 AIShell…

421 0 0
WeNet开源社区介绍
转载4 years ago
WeNet开源社区介绍

本文是由张彬彬在第二届SH语音技术研讨会和第七届Kaldi技术交流会上对WeNet开源社区的一些工作上的整理,内容涵盖了 WeNet 的最新进展、新项目WeKws,WeSpeeker和WeTextProcessing的介绍,以及去年发布的两…

820 0 0