声浪
来源丨子曰MusicTech 概况介绍 CCMUSIC DATASET-用于计算音乐学学术研究的多功能音乐数据分享平台,包含三个数据库:中国传统乐器音响数据库(CTIS)、用于MIR研究的多功能音乐数据库、流行歌曲midi-wav双向数据库…
来源丨阿里语音AI Themeetingscenario is one of the most valuable and, at the same time, most challenging scenarios for speech te…
从事语音降噪增强算法开发多年了,上学期间和入行的前段都是做传统信号处理算法。19年以后基于深度学习的语音降噪模型凭借其优秀的处理效果,一时风头无两,似乎每个人都开始走上了模型降噪的路子。 特别是从2020年微软开始举办的Deep Noise…
声明:平时看些文章做些笔记分享出来,文章中难免存在错误的地方,还望大家海涵。搜集一些资料,方便查阅学习:http://yqli.tech/page/speech.html。语音合成领域论文列表请访问http://yqli.tech/page…
腾讯会议天籁实验室携手腾讯AI Lab,共同打造的Penguins,于2021腾讯技术生态大会上正式面世。Penguins是一款超低码率、高质量AI-Codec,支持多种运行模式,以满足RTC场景下多种应用诉求。其核心技术点在于,紧密结合经…
The ICASSP 2022 organization committee is soliciting proposals for a Show & Tell Demo event that will be held during the…
由CCF语音对话与听觉专委会 、中国人工智能产业发展联盟(AIIA)评估组 、北京声智科技有限公司、语音之家社区、北京希尔贝壳科技有限公司共同主办的【语音之家】AI产业沙龙-站在未来思考下一代人工智能基础框架,将于2021年11月6日10:…
原场语音识别(Distant ASR) 原场语音识别中的挑战 混响 背景噪声 其他说话人的插入、打断等 远场语音识别系统 主要有这几个模块构成: 语音增强前端 特征提取 模型自适应 解码器 声学模型 字典 语言模型
