岗位职责:
1. 负责语音合成(TTS)的算法研发、性能优化与落地实现;
2. 负责虚拟人交互场景下的个性化实时情感对话语音合成、篇章语音合成、低资源音色克隆、文本和语音驱动表情生成、多风格歌声合成、嘻哈合成、舞蹈动作生成、变声、空间音频等技术研发;
3. 跟进学术界、行业最新的研究趋势,产出新的科研成果,并落地于实际产品。
任职要求:
1. 硕士或博士(优秀本科生亦可),人工智能、语音、自然语言处理、机器学习、信号处理、计算机、电子信息、自动化等相关专业方向,两年以上语音合成的算法研究和项目开发经验;
2. 深刻理解 TTS 原理,熟悉TTS前端TN、G2P、韵律预测等,熟悉开源架构声学模型 Tacotron、FastSpeech、VITS和声码器WaveGlow、WaveRNN、HifiGAN等;
3. 熟练掌握机器学习算法,有较强的算法实现能力,熟练掌握 Python/C/C++/Java/Shell编程,熟悉Linux系统,至少熟练使用一种深度学习训练框架,如Tensorflow、Pytorch 等;
4. 在计算及科学相关会议或期刊(如IEEE TASLP、Speech Communication、NIPS、ICML、ICASSP、Interspeech、ASRU、ISCSLP等)发表过文章,或者参加过相关国际比赛者优先;
5. 学习能力强,优秀的分析问题和解决问题的能力,对解决具有挑战性的问题充满激情;