面向听觉智能与物理AI的
人机交互开发者社区

发现模型、参与赛事、分享实践、连接同行,共创数据、模型与评测驱动的人机交互生态。

50k+
注册开发者
5.8k+
技术文章
268+
开源数据集
300+
技术课程

最新声浪

查看全部 →
车企奇瑞-上海开阳招聘
原创3 months ago
车企奇瑞-上海开阳招聘

工作地址:上海市朱梅路地铁站附近。 岗位一、音频算法工程师:5人 岗位职责: 1. 负责全景声算法(音乐分离、空间音频等)的设计实现、移植调试。 2. 负责无麦K歌、啸叫抑制等算法的设计实现、移植调试。 3. 负责车内外通话(AI降噪、AE…

456 2 0
Interspeech 2026|Decoding the Ear(DeEAR):从人类偏好中客观量化语音表现力的对齐框架
原创3 months ago
Interspeech 2026|Decoding the Ear(DeEAR):从人类偏好中客观量化语音表现力的对齐框架

近年来,端到端口语对话(S2S)与语音合成(TTS)技术正加速从“可懂、可用”向“自然、拟人”发展。尤其在智能座舱、语音助手等实际应用场景中,用户对语音交互的期待已不再局限于内容准确,还希望模型能够展现接近真人的表现力,包括细腻的情绪起伏、…

26 0 0

为语音开发者而生