随着物联网技术和智能设备技术的快速发展,人与机器的交互,不再仅依赖于鼠标和键盘,更有可能的是直接采用语音。 这其中的关键技术就是自动语音识别(Automatic Speech Recognition,ASR)。其所要完成的工作,简单地说,就…
声浪
在语音识别系统的现实使用环境中,噪声、干扰和混响几乎是无处不在的。在麦克采集到的音频信号中,这些不利因素和目标语音信号叠加在一起,会带来识别率的下降,而在远场环境中更是如此。如图3-1所示,远场环境中可能同时存在反射声、扬声器回声、干扰用户…
人类信息获取20%来自听觉,信息表达93%借助语言和声音,语音是人类沟通和获取信息最自然、最便捷的方式。 在人工智能技术中,语音技术是人类最容易感知的技术之一,由于在一句话中可以传递内容、身份、情感等多层次信息,语音正在成为继键盘、鼠标、触…
近日,网易伏羲虚拟交互团队与西工大音频语音与语言处理研究组谢磊团队合作的两篇论文被ICASSP 2022接收,并受邀在本届大会上向学术与工业界进行研究报告。同时网易伏羲也将歌声合成方面的最新研究成果,向业界和学术界进行回馈,开源全球首个中文…
中国科学院噪声与振动重点实验室Lab9_DSP411团队参加了由IEEE声学、语音和信号处理国际会议(IEEE International Conference on Acoustics, Speech and Signal Process…
西工大音频语音与语言处理研究组(ASLP@NPU)近期在微软举办的ICASSP2022回声消除国际评测(AEC Challenge)上获得第三名的优异成绩,现对竞赛方案进行分享。 人们在远距离实时语音通信(RTC)时,从拾音、编码、传输到放…
3月3日爱耳日,中国联通联合腾讯会议旗下天籁实验室发布“畅听王卡升级版”,在语音通话和实时字幕双场景下,让听障用户不仅“听得清”,同时也能“看得清”。 在这背后,依托于天籁实验室专为听障人群打造的天籁AI语音辅听/增强算法,创造性地采用了“…
本文总结于平线智能座舱团队-杨超在深蓝学院关于智能座舱中的多模语音交互的公开课。 智能座舱的介绍 汽车座舱是指车内的驾驶和乘坐空间,智能座舱,及智能化的汽车座舱。行业内目前还没有关于智能座舱的标准定义。我们可以简单的说,智能座舱通过配备智能…
Meta 正在致力于通过语音生成元宇宙世界的人工智能研究,还有很多神奇的技术。首席执行官马克 · 扎克伯格本周三表示,该公司正在研究改善人们与语音助手交流顺畅程度,以及在不同语言之间进行翻译的方式。 最近一段时间,扎克伯格正带领脸书 all…
