IEEE ASRU 2025特别议题:“SS1: Responsible Speech and Audio Generative AI” 本次会议将于12月在夏威夷檀香山举行🌴🏝️本专题聚焦“负责任”的语音与音频生成技术——包括传统生成模型(TTS、VC、歌声合成、音乐与音效生成)以及新兴的语音/音频大型语言模型,以期促进更安全、公平、透明的研究与应用。欢迎来自学术界与工业界的研究人员积极投稿。
投稿截止:2025年5月28日
官方网站:https://codecfake.github.io/RespSA-GenAI/
投稿指南
提交时请务必在系统中选择“SS1: Responsible Speech and Audio Generative AI”作为您的主议题,以确保您的论文被正确纳入本专题评审。
征稿方向
近年来,语音与音频生成式 AI 技术,包括但不限于传统 TTS/VC、歌声合成、音乐生成及各类大型语言模型,取得了跨越式发展,为媒体制作、无障碍服务和人机交互带来全新机遇,同时也带来偏见风险、滥用隐患、问责困难与透明性不足等伦理挑战。
本专题拟聚焦以下关键问题:
- 音频水印 (Neural Watermarking):探索更高效、鲁棒的防伪与溯源技术;
- 可控性(Controllability):实现对生成参数与表达效果的精细化把控;
- 公平性 (Fairness):识别、评估并减轻模型在不同群体上的偏见;
- 可解释性(Explainability):构建透明、可审计的决策与生成流程;
- 度量方法(Measurement):建立统一的质量与可靠性评估基准。
重要时间节点
与 IEEE ASRU 2025 同步, 以 AoE 时间为准:
| 2025.3.28 | 投稿开放 |
| 2025.5.28 | 投稿截止 |
| 2025.6.4 | 论文修订截止 |
| 2025.8.6 | 录用通知 |
| 2025.8.13 | 最终稿截止 |
| 待定 | 会议日期 |
组织团队
- Dr. Nicholas Andrews(Johns Hopkins University)
- Mr. Xuanjun Chen(National Taiwan University)
- Dr. Sung-Feng Huang(NVIDIA)
- Prof. Hung-yi Lee(National Taiwan University)
- Mr. Yuanchao Li(University of Edinburgh)
- Dr. Hemlata Tak (Pindrop)
- Dr. Jennifer Williams(University of Southampton)
- Dr. Haibin Wu(Microsoft)
