作者:李亚军 周赵鹏 作业帮实时音视频ZRTC经过流媒体技术团队的持续打磨和优化,已在大规模复杂的生产环境稳定运行3年以上,不仅有力地支持了作业帮丰富多彩的互动课程类型,同时也积累了丰富和宝贵的实践经验,今天我们一起来回顾并总结其中的关键技…
声浪
cs.SD语音,共计2篇,eess.AS音频处理,共计5篇 1.cs.SD语音: 【1】 MIMII DG: Sound Dataset for Malfunctioning Industrial Machine Investigation…
字节跳动人工智能实验室和加利福尼亚大学圣塔芭芭拉分校的研究者提出了跨语言流形混合(X-Mixup)方法为目标语言提供 “折衷” 的表示,让模型自适应地校准表示差异。此方法不仅显著地减少了跨语言表示差异,同时有效地提升了跨语言迁移的效果。 来…
文章来源于阿里语音AI 文章介绍在非对齐序列的多模态情感分析场景中,一种基于holographic reduced representation的表征融合方法。 ICASSP收录论文:Mutimodal Sentiment Analysis…
网易云信音频实验室持续在实时通信音频领域进行创新,基于 AI 的啸叫检测方法的研究方案被 ICASSP 2022 接收,并受邀于会议面向学术界和工业界进行研究报告。 来源丨机器之心 作者丨网易云信音频实验室 ICASSP (Internat…
本文由哈工程智能信号处理组与悉尼科技大学、萨里大学合作,论文一作为2017级本科生柳友德。无监督异常声音检测旨在仅有机器正常声音数据的情况下,实现对机器的未知异常检测。然而,当前方法在异常检测时仍缺乏稳定性,对于同类型的不同设备的异常检测表…
cs.SD语音,共计3篇,eess.AS音频处理,共计4篇 1.cs.SD语音: 【1】 DT-SV: A Transformer-based Time-domain Approach for Speaker Verification 标题…
国际最受关注的自然语言处理自然语言处理(NLP)顶级会议 ACL 2022 于今年 5 月 22 日至 27 日举行,包括爱尔兰都柏林的线下会议及线上会议两部分。 来源丨腾讯AI Lab微信(tencent_ailab) 腾讯 AI Lab…
翻唱识别(CSI)是音乐信息检索(MIR)领域的一项重要任务,在歌曲搜索,音乐分发,曲库整理,智能推荐等场景下有着重要作用,被誉为下一代音乐识别技术。 来源丨机器之心
cs.SD语音,共计9篇,eess.AS音频处理,共计10篇 1.cs.SD语音: 【1】 On Building Spoken Language Understanding Systems for Low Resourced Langua…
