目标说话人提取(Target Speaker Extraction, TSE)旨在从包含多个说话人的复杂音频中分离出特定的说话人的语音。在诸如会议交流和家庭聚会等场景中,存在诸多干扰说话人和背景噪声,这种情况下对特定说话人的语音提取是一项极…
声浪
ICASSP2024 | 基于音频质量的多策略目标说话人提取
41 0 0
IBM安全研究人员揭示了劫持实时对话的深度伪造人工智能音频攻击
IBM安全研究人员最近发现了一种“令人惊讶且极其简单”的技术,可以使用人工智能 (AI) 劫持和操纵实时对话。 这种被称为“音频劫持”的攻击依赖于生成人工智能(一类人工智能,包括OpenAI 的ChatGPT和Meta的Llama-2)和D…
13 0 0
音乐人声分离工具:极简的人声和背景音乐分离工具
这是一个极简的人声和背景音乐分离工具,本地化网页操作,无需连接外网,使用 2stems/4stems/5stems 模型。 来源丨GitHubStore 将一首歌曲或者含有背景音乐的音视频文件,拖拽到本地网页中,即可将其中的人声和音乐声分离…
33 0 0
