
1、语言模型/声学模型大规模训练平台的研发与优化;
2、语音识别声学模型技术的研发、优化;
3、语音识别性能的提升,包括识别准确及业务场景的召回/准确;
4、语音解码服务的性能优化,包括WFST、beam search的维护和优化;
5、前沿语音识别技术跟踪。
1、计算机、信号处理或者相关方向,硕士及以上学历;
2、熟悉bash、python、C/C++等基本编程语言,对数据结构和算法有深刻理解;
3、熟练掌握Kaldi-base语音识别模型及E2E语音识别模型的训练和优化,跟踪前沿技术;
4、熟悉wfst、beam search解码原理及其优化方法;
5、有语音领域的顶会或高级别期刊一作论文者优先。
1、负责前端文本分析处理,包括分词、韵律、g2p等;
2、负责声学建模、声码器等算法研发、模型训练优化及工程化落地;
3、负责语音合成算法集成及系统开发,并解决线上问题;
4、负责下一代语音合成技术的研究,包括个性化技术、风格迁移、语音转换、情感合成等。
1、计算机、电子信息、自动化等相关专业硕士及以上学历,具备语音合成、语音识别、信号处理、自然语言处理等领域相关经验,对语音合成相关算法有深刻的理解;
2、熟练使用tensorflow/pytorch等工具;
3、具有良好的学习能力,团队协作与沟通能力;
4、在icassp或interspeech有语音合成相关的论文发表者优先。
1、声纹识别相关技术的研发及开发,包括说话人识别、说话人聚类、话者分离(speaker diarization)、录音回放监测(anti-spoofing)等算法;
2、理解用户需求,进行数据收集清洗、算法的改进和验收,并将成果应用于工业级声纹识别系统;
3、声纹识别相关前沿算法的跟踪及预研。
1、硕士以上学历,数学功底良好,较强的代码编写能力,信号处理、计算机、模式识别等相关专业;
2、2年以上相关工作经验,熟练掌握python/c/c++,熟悉Linux平台,了解声纹识别/语音信号处理/人脸识别的相关背景知识;
3、有深度学习研究背景,能够熟练使用Pytorch/tensorflow/kaldi等工具;
4、具备优秀的逻辑思维能力,善于分析问题和解决问题,积极主动有探索精神,有强烈的上进心和求知欲,较强的沟通能力和学习能力;
5、发表过InterSpeech、ICASSP等领域论文者优先。
BIGO于 2014 年成立,是一家高速发展的科技公司,BIGO 基于强大的音视频处理技术、全球音视频实时传输技术、人工智能技术、CDN 技术,推出了一系列音视频类社交及内容产品,包括 Bigo Live、Likee、Hello 语音等。
目前,BIGO在全球已拥有近 4 亿月活用户,产品及服务已覆盖超过 150 个国家和地区。为了让用户更积极、自在、安全地感受世界的精彩,BIGO 一直不懈地探索前沿技术,提升自身研发水平,现已在中国(北京、上海、广州、杭州)、新加坡、美国(硅谷)建立了 6 个研发中心。BIGO 深耕本地化运营和本土团队建设,拥有产品、运营、营销、业务等全方位本土化落地能力,已在全球建立 30余个本地办公室。
