声浪
科大讯飞| 招聘语音算法工程师(语音合成/说话人转化/Voice Conversion)
科大讯飞 科大讯飞股份有限公司成立于1999年,是亚太地区知名的智能语音和人工智能上市企业。自成立以来,一直从事智能语音、计算机视觉、自然语言处理、认知智能等人工智能核心技术研究并保持国际前沿水平。科大讯飞积极推动人工智能源头核心技术研发和…
43 0 0
Interspeech2024丨FluentEditor:考虑声学和韵律一致性的基于文本的语音编辑
本次分享由内蒙古大学计算机学院S2Lab实验室(https://ttslr.github.io)刘瑞研究员团队投稿在 InterSpeech 2024的论文《FLUENTEDITOR: TEXT-BASED SPEECH EDITING B…
12 0 0
INTERSPEECH2024丨上海交通大学听觉认知与计算声学实验室5篇录用论文分享
分享5篇上海交通大学听觉认知与计算声学实验室被INTERSPEECH 2024录用的论文,论文方向涵盖语音增强、语音识别、语音合成、模型压缩等。以下是发表论文的相关信息: 01、Beyond Performance Plateaus: A…
9 0 0
元象 XVERSE | 招聘语音合成算法工程师(深圳)
元象 XVERSE 元象 XVERSE 于 2021 年初在深圳成立,是国内领先的 AI 与 3D 技术服务公司,致力于打造 AI 驱动的 3D 内容生产与消费一站式平台,愿景为“定义你的世界”。 元象创始人姚星是前腾讯副总裁和腾讯 AI…
37 0 0
INTERSPEECH2024 | WenetSpeech4TTS: 12800小时中文大规模语音生成模型训练数据集
得益于大规模语音合成 (TTS) 模型的发展和训练数据规模的扩大, 当下的TTS 系统取得了令人瞩目的表现。其中,获取到大规模的训练数据集是训练良好效果模型的前提。然而,当前 TTS 系统所用的现有大规模开源数据集大都是英文或是多语种的,相…
51 0 0
