由来自上海交通大学、南洋理工大学、伦敦玛丽女王大学、卡内基梅隆大学、英伟达、阿里巴巴、微软的研究者们联合举办的Interspeech 2026音频推理挑战赛现已开启!本次挑战赛旨在解决当前大型音频语言模型(LALM)推理能力有限且不稳定的问题,聚焦于复杂声学场景下的思维链(CoT)推理能力。挑战赛设有以下两个赛道:
● 单模型赛道 (Single Model Track): 聚焦于基于开源模型进行数据创新与训练创新,提升模型内在的推理能力。
● 智能体赛道 (Agent Track): 聚焦于基于开源模型的系统级编排与工具调用能力。
挑战赛将会同时测评模型结果和推理过程的准确性与逻辑性,希望本次挑战能够激发音频推理领域新的模型创新和系统创新。所有参赛队伍均可以在Interspeech 2026主会提交系统报告或研究论文,欢迎大家报名参加,相聚悉尼!
赛事官网:https://audio-reasoning-challenge.github.io/
赛事海报

重要日期
2025.12.1:发布挑战赛详细规则的公告
2026.1.1:排行榜上线,开始接受结果提交
2026.2.1:排行榜提交截止,届时将停止提交与排名更新
2026.2.10:代码核查,提供最终排名并宣布获胜者
2026.2.25:论文提交截止(流程与主会同行评审一致)
组织者
马子阳(上海交通大学 & 南洋理工大学)
马英浩(伦敦玛丽女王大学)
Chao-Han Huck Yang(英伟达)
徐瑞阳(上海交通大学)
李波含(上海交通大学)
Jaeyeon Kim(卡内基梅隆大学)
徐进(阿里巴巴)
李锦宇(微软)
Carlos Busso(卡内基梅隆大学)
俞凯(上海交通大学)
Eng Siong Chng(南洋理工大学)
陈谐(上海交通大学)
报名方式
请扫描海报上的Google表单或进入官方网站寻找报名Google表单进行注册,只有成功注册者才可以在后续leaderboard上进行提交。
关于任何比赛信息,请加入Slack频道或微信群进行咨询(如海报上的微信群二维码过期,请前往官网扫描最新的入群二维码)
