异常声音检测(Anomalous Sound Detection,ASD)是指在仅知道机器正常工作声音的前提下,判断待测机器声音是否存在异常。近期,清华大学联合上海交通大学、华北电力大学等单位,提出了一种面向工况属性信息不完备场景的自适应原…
声浪
为了更好地推动语音对话与听觉处理领域的深入交流与前沿研究,由中国计算机学会(CCF)语音对话与听觉专委会现向全社会业界同仁征集第二届语音对话与听觉处理前沿进展研讨会(RASDAP2025, Recent Advances on Speech…
传音控股致力于成为新兴市场消费者最喜爱的智能终端产品和移动互联服务提供商。自公司成立以来,传音一直着力为用户提供优质的以手机为核心的多品牌智能终端,并基于自主研发的智能终端操作系统和流量入口,为用户提供移动互联网服务。传音旗下拥有新兴市场知…
近年来,AI 作曲与歌声合成技术突飞猛进,但如何像人类一样评价一首“AI 歌曲”的美感始终是一大难题。现有客观指标往往忽视旋律记忆点、情感连贯性等主观维度,导致模型优化方向失焦。 为此,西工大音频语音与语言处理研究组(ASLP@NPU)与上…
中国西北工业大学科研团队在深海远程水声通信领域取得进展,成功研发自适应簇稀疏贝叶斯学习(ACSBL)信道估计算法及时延-多普勒域Turbo均衡器(DD-TEQ),并在南海海域试验中实现324.9公里和595.1公里的深海无差错通信。这一成果…
语音合成(TTS)技术近十年来突飞猛进,从早期的拼接式合成和统计参数模型,发展到如今的深度神经网络与扩散、GAN等先进架构,实现了接近真人的自然度与情感表达,广泛赋能智能助手、无障碍阅读、沉浸式娱乐等场景。 然而,这一繁荣几乎局限于英语、普…
北航刘偲教授团队创新性地提出了语言引导的细粒度无人机轨迹控制研究框架,将无人机根据简短指令执行短距反应式飞行的任务定义为Flying-on-a-Word(Flow)范式。 论文链接:https://arxiv.org/abs/2505.15…
字节跳动成立于2012年3月,公司使命为“Inspire Creativity, Enrich Life(激发创造,丰富生活)”。公司业务覆盖150个国家和地区、75个语种,拥有超过6万名员工。字节跳动在全球推出了多款有影响力的产品,包括今…
