Force alignment(强制对齐)是语音任务中的一个常用模块,在帧级别的语音识别和语音合成任务中应用广泛,同时也是字幕自动打轴、口语评测等任务中的核心算法。强制对齐和识别解码有一定的相似性,识别解码是指给定一个语音识别模型,输入一个…
声浪
WeNet更新:支持 CTC alignment
195 0 0
WeNet 更新:支持字级时间戳和 N-best
WeNet更新支持了时间戳。解码器不仅可以返回 Nbest 解码结果,而且还可以返回其中每个字对应的时间信息。 在语音识别一些任务中,字级别的的时间戳和N-best 扮演着重要的作用。例如在视频应用中,语音识别结合字级别的时间戳可以在精确的…
476 30 0
WeNet更新:支持AISHELL-2数据集并开放预训练模型
希尔贝壳和出门问问合作,在 WeNet 中更新了对 AISHELL-2 数据集的支持,开放数据准备、训练和解码测试和部署等流程,并开放基于 AISHELL-2 的预训练模型。其中,AISHELL-2 数据由希尔贝壳提供。希尔贝壳开源数据致力…
693 32 0
用 WeNet 搭建 Android 语音识别系统
WeNet是出门问问联合西北工业大学推出的端到端语音识别工具,并且已经开源在Github上。为了方便大家使用,本文将教大家如何在Android手机中构建一个语音识别系统。 本文示例运行的环境为CPU (Intel x86_64) + Mac…
695 52 0
WeNet更新:支持中文开源1385h数据集并开放预训练模型
WeNet自发布以来,日前已经成为最流行、最受欢迎的开源端到端语音识别工具。下图是几个典型端到端识别工具Github的Star History。 目前,WeNet已经支持了AIshell-1, AIshell-2, LibriSpeech三…
1145 56 0
出门问问联合西北工业大学推出端到端语音识别工具WeNet
出门问问联合西北工业大学音频语音与语言处理研究组推出面向产品和工业界的端到端语音识别开源工具WeNet,WeNet致力于消除从端到端模型研究到产品落地中的鸿沟,探索更适合工业级产品的端到端解决方案。 目前WeNet项目已经开源到 https…
1002 35 0
WeNet更新:支持多机并行训练
作者:忧郁的白衬衫 WeNet(https://github.com/mobvoi/wenet)支持了多机多卡的分布式并行训练,进而可以利用更多的来加速模型的训练。目前的方案使用PyTorch原生的DistributedDataParall…
733 112 0
