面向听觉智能与物理AI的
人机交互开发者社区

发现模型、参与赛事、分享实践、连接同行,共创数据、模型与评测驱动的人机交互生态。

50k+
注册开发者
5.8k+
技术文章
268+
开源数据集
300+
技术课程

最新声浪

查看全部 →
语音与音频学术速递[9.16]
原创24 days ago
语音与音频学术速递[9.16]

今日论文合集:CS.SD语音与音频 | 共 9 篇。 本文经arXiv每日学术速递授权转载,微信公众号:arXiv_Daily [机构]信息由AI分析生成,可能存在错误,仅供参考,以论文实际显示为准 快速导航 1. 语音识别与关键词检测 1…

14 0 0
Xiaomi-CocktailASR-1:小米开源目标说话人语音识别模型
转载25 days ago
Xiaomi-CocktailASR-1:小米开源目标说话人语音识别模型

在多人同时说话的场景里,语音识别一直面临一个特殊问题:系统能够听见很多声音,却很难判断其中哪一句属于指定的人。 会议录音、多人通话、车载语音、家庭环境中的语音控制,都存在类似情况。传统方案通常需要先进行语音分离,再把分离后的目标声音交给 A…

26 1 0
语音与音频学术速递[9.15]
原创25 days ago
语音与音频学术速递[9.15]

今日论文合集:CS.SD语音与音频 | 共 30 篇。 本文经arXiv每日学术速递授权转载,微信公众号:arXiv_Daily [机构]信息由AI分析生成,可能存在错误,仅供参考,以论文实际显示为准 快速导航 1. 语音识别与关键词检测…

18 0 0
语音与音频学术速递[9.14]
原创a month ago
语音与音频学术速递[9.14]

今日论文合集:CS.SD语音与音频 | 共 9 篇。 本文经arXiv每日学术速递授权转载,微信公众号:arXiv_Daily [机构]信息由AI分析生成,可能存在错误,仅供参考,以论文实际显示为准 快速导航 1. 语音合成与声音生成 2…

21 0 0

为语音开发者而生