语音识别大杀器:详解Seq2Seq模型在语音识别中的应用
原创6 years ago
语音识别大杀器:详解Seq2Seq模型在语音识别中的应用

全文导读 对于一些自然语言处理任务,比如聊天机器人,机器翻译,自动文摘等,传统的方法都是从候选集中选出答案,这对素材的完善程度要求很高,随着最近几年深度学习的兴起,国外学者将深度学习技术应用与自然语言的生成和自然语言的理解的方面的研究,并取…

99 0 0
语音合成的速度如何提升400%?
原创6 years ago
语音合成的速度如何提升400%?

全文导读 阿里在曾提出一种语音合成系统因其基于深度前馈序列记忆网络,在达到与基于双向长短时记忆单元的语音合成系统一致的主观听感的同时,合成速度是后者的400%,但是模型大小只有后者的四分之一,这对于内存占用和计算效率非常敏感的端上产品环境是…

25 0 0
使用 TensorFlow Lite 在嵌入式端部
转载6 years ago
使用 TensorFlow Lite 在嵌入式端部

1、背景 热词唤醒 (Keyword Spotting) 往往是用户对语音交互体验的第一印象,要做到准确快速。因此热词检测算法要同时保证高唤醒率和低误唤醒率,能够准确地区分热词和非热词的音频信号。主流的热词检测方法,通常使用深度神经网络来从…

25 0 0
【第七期】AI Talk:端到端语音合成及其优化实践(上)
转载6 years ago
【第七期】AI Talk:端到端语音合成及其优化实践(上)

1、前言 语音合成系统分为前端和后端,前端负责分词、词性、多音字标注等文本特征信息提取;后端模块根据前端提取的文本特征完成语音生成。从技术角度,传统后端模块又可以细分为拼接系统和参数系统,拼接系统和参数系统各有优缺点,详细对比可以参照 AI…

12 0 0