WebRTC VAD流程解析
转载5 years ago
WebRTC VAD流程解析

语音活动检测算法大致可以分为三类,第一类就是最简单的基于阈值的判别方法,这个以前讲过了,参考语音活动检测;第二类是WebRTC使用的基于GMM的检测方法;第三类就是基于深度学习的检测方法,这个也讲过了,参考

187 0 0
IEEE S&P 2022丨速度提升达4-6个数量级,港科大、星云Clustar联合提出隐私保护的在线机器学习新框架
转载5 years ago
IEEE S&P 2022丨速度提升达4-6个数量级,港科大、星云Clustar联合提出隐私保护的在线机器学习新框架

为了解决现有隐私保护计算技术不适用于深度神经网络在线学习任务以及部分隐私保护计算工具的性能问题,香港科大智能网络与系统实验室iSING Lab和国内隐私计算算力提供商星云 Clustar 合作,提出了一种隐私保护在线机器学习场景下的新框架—…

255 0 0
使用互相关进行音频对齐
转载5 years ago
使用互相关进行音频对齐

在计算一些音频指标如SNR的时候,我们需要音频信号与参考信号对齐,但有时候我们处理后的或者录制的音频并不是与参考信号对齐的,这就需要找到一种方法将它们对齐。 01 互相关函数

193 0 0
语音识别的快速纠错模型FastCorrect系列来了!
转载5 years ago
语音识别的快速纠错模型FastCorrect系列来了!

以下文章来源于微软研究院AI头条,作者冷燚冲、谭旭 语音识别支持着许多生活中的常见服务,比如手机端的语音转文字功能、视频网站的字幕自动生成等等。但语音识别模型往往并不完美,需要纠错模型来纠正语音识别中的错误。目前,大部分纠错模型采用了基于注…

139 0 0
基于音频指纹的听歌识曲系统
转载5 years ago
基于音频指纹的听歌识曲系统

听歌识曲,我想大家都不陌生。虽然不同的厂商识别率不同(可能是因为版权的原因),但是每个音乐APP都会有这么一个功能。我们以扣扣音乐为例,扣扣音乐听歌识曲功能比较丰富,不仅有基本的听歌识曲还有哼唱识别,识别到对应的歌曲后就直接返回对应的结果,…

179 0 0
大厂白嫖拖垮开源!开源届码农:用户脾气大需求多还不给钱
转载5 years ago
大厂白嫖拖垮开源!开源届码农:用户脾气大需求多还不给钱

现在,开源软件界或即将到达必须变革的临界点:被大厂白嫖的既有模式不可持续,开源码农必须得到相应尊重和报偿。 如果有一天,你的开源项目被像谷歌或Meta这种大厂相中,是不是有种能横着走的感觉? 但入选一时爽、维护火葬场,开源项目最终掏空开发者…

234 0 0