ICASSP2025丨上交大跨媒体语言智能实验室12篇录用论文分享
近日,ICASSP 2025会议发出了审稿结果通知,上海交通大学跨媒体语言智能实验室共12篇论文被会议接收,论文方向涵盖语音识别、语音合成、音频描述、音频生成、视频生成、音频增强等。 以下是12篇论文的介绍及分享: 01、SLAM-AAC:…
14 0 0
近日,ICASSP 2025会议发出了审稿结果通知,上海交通大学跨媒体语言智能实验室共12篇论文被会议接收,论文方向涵盖语音识别、语音合成、音频描述、音频生成、视频生成、音频增强等。 以下是12篇论文的介绍及分享: 01、SLAM-AAC:…
Amp’ed RF安普德2003年创立于美国硅谷,并于2009年12月在中国天津滨海高新区华苑产业园注册成立,依托两地优势,我们聚集众多无线射频芯片和无线物联技术的高端人才,潜心研究、锐意进取,现已逐步成为国内外同行业中同时可提供无线射频芯…
Adobe 与 Northwestern University 联合推出创新音频生成模型Sketch2Sound。 论文地址:https://arxiv.org/pdf/2412.08550
来源丨机器之心 本文介绍「INFP」的交互式人像生成技术。利用该技术生成的智能体能像真人一样在多轮对话中实现自由的听说行为以及无缝的状态切换。 论文链接:
近日,2025年IEEE声学、语音与信号处理国际会议(2025 IEEE International Conference on Acoustics, Speech, and Signal Processing, ICASSP 2025),…
近日,2025年IEEE声学、语音与信号处理国际会议(2025 IEEE International Conference on Acoustics, Speech, and Signal Processing, ICASSP 2025)发…