CNN在语音识别中的应用
转载6 years ago
CNN在语音识别中的应用

2012年,微软邓力和俞栋老师将前馈神经网络FFDNN(Feed Forward Deep Neural Network)引入到声学模型建模中,将FFDNN的输出层概率用于替换之前GMM-HMM中使用GMM计算的输出概率,引领了DNN-HM…

17 0 0
万字长文带你轻松了解LSTM全貌
转载6 years ago
万字长文带你轻松了解LSTM全貌

第一次接触长短期记忆神经网络(LSTM)时,我惊呆了。 原来,LSTM是神经网络的扩展,非常简单。深度学习在过去的几年里取得了许多惊人的成果,均与LSTM息息相关。因此,在本篇文章中我会用尽可能直观的方式为大家介绍LSTM——方便大家日后自…

17 0 0
语音音频格式介绍
原创6 years ago
语音音频格式介绍

语音识别是基于语音的基础之上,因此对音频有一个深入的了解可以更好的帮我们理解语音,而语音的存储格式有很多,譬如pcm/wav,mp1/mp2/mp3,amr,wma,aac,opus等等,这次仅仅来说下最常见的格式PCM跟WAVE。 PCM…

34 0 0
课程分享——国内外语音课程
转载6 years ago
课程分享——国内外语音课程

正所谓学无止境,再厉害的人也不可能样样精通,所以只有一直坚持学习才能提高自我,成就更高的自我,今天就来给大家推荐几个关于语音的课程: ①上海交通大学俞凯老师的课程: 连接:https://speechlab.sjtu.edu.cn/~kyu…

72 0 0
语音识别系列——数据终结篇
原创6 years ago
语音识别系列——数据终结篇

这篇文章主要来写下kaldi中数据处理的一些内容。如果我们拿到一个新的数据库,我们根据数据准备阶段准备数据,然后咱们开始训练模型。但基础数据往往是单一的,我们怎么才能让数据变多呢。首先这里引用来自阿里巴巴的薛少飞之前的一个ppt: 目前在基…

203 0 0