要说生活里最常见的AI应用场景,语音合成与识别当属大家最为耳熟能详的场景之一了。寻常到平时地图导航的播报、微信语音转文字、手机语音输入,以及小度智能音箱,都离不开语音技术的加持。语音技术到底是怎么实现的?有哪些现成可用的开源代码可以快速集成到项目里?可以说是每一名开发者非常关心的问题。
那么,福利时间到了,今天这个集成了中英文语音识别、语音翻译、语音合成、声音分类能力,而且一行代码轻松试验效果的开源项目,你一定不能错过!
项目介绍
语音识别
输入音频1 戳我即可听音频
语音翻译(英译中)
输入音频 戳我即可听音频
识别结果 我 在 这栋 建筑 的 古老 门上 敲门。
语音合成
输入文本1 Life was like a box of chocolates, you never know what you're gonna get.
合成音频1 戳我即可听音频
合成音频2 戳我即可听音频
安装测试效果





丰富的预训练模型
语音识别包含声学模型和语言模型, 详情如下:


完善的文档教程


PaddleSpeech项目地址:
GitHub:
https://github.com/PaddlePaddle/PaddleSpeech
Gitee:
https://gitee.com/paddlepaddle/PaddleSpeech
