IEEE ASRU 2025特别议题:“SS1: Responsible Speech and Audio Generative AI” 本次会议将于12月在夏威夷檀香山举行🌴🏝️本专题聚焦“负责任”的语音与音频生成技术——包括传统生成模型(TTS、VC、歌声合成、音乐与音效生成)以及新兴的语音/音频大型语言模型,以期促进更安全、公平、透明的研究与应用。欢迎来自学术界与工业界的研究人员积极投稿。

投稿截止:2025年5月28日

官方网站:https://codecfake.github.io/RespSA-GenAI/


投稿指南

提交时请务必在系统中选择“SS1: Responsible Speech and Audio Generative AI”作为您的主议题,以确保您的论文被正确纳入本专题评审。


征稿方向

近年来,语音与音频生成式 AI 技术,包括但不限于传统 TTS/VC、歌声合成、音乐生成及各类大型语言模型,取得了跨越式发展,为媒体制作、无障碍服务和人机交互带来全新机遇,同时也带来偏见风险、滥用隐患、问责困难与透明性不足等伦理挑战。

本专题拟聚焦以下关键问题:

  • 音频水印 (Neural Watermarking):探索更高效、鲁棒的防伪与溯源技术;
  • 可控性(Controllability):实现对生成参数与表达效果的精细化把控;
  • 公平性 (Fairness):识别、评估并减轻模型在不同群体上的偏见;
  • 可解释性(Explainability):构建透明、可审计的决策与生成流程;
  • 度量方法(Measurement):建立统一的质量与可靠性评估基准。


重要时间节点

与 IEEE ASRU 2025 同步, 以 AoE 时间为准:

2025.3.28投稿开放
2025.5.28投稿截止
2025.6.4论文修订截止
2025.8.6录用通知
2025.8.13最终稿截止
待定会议日期


组织团队

  • Dr. Nicholas Andrews(Johns Hopkins University)
  • Mr. Xuanjun Chen(National Taiwan University)
  • Dr. Sung-Feng Huang(NVIDIA)
  • Prof. Hung-yi Lee(National Taiwan University)
  • Mr. Yuanchao Li(University of Edinburgh)
  • Dr. Hemlata Tak (Pindrop)
  • Dr. Jennifer Williams(University of Southampton)
  • Dr. Haibin Wu(Microsoft)