腾讯联合北大刷新AISHELL SOTA(附代码开源)
转载5 years ago
腾讯联合北大刷新AISHELL SOTA(附代码开源)

近期,来自北京大学和腾讯AI LAB, ASR oteam的研究人员在主流端到端语音识别系统上进行了两点改进:(1)将LF-MMI准则用于端到端语音识别系统的训练和解码中;(2)使用词级别N-gram模型进行在线解码。集成上述两点的端到端模…

400 0 0
AI 看唇语,在嘈杂场景的语音识别准确率高达75%
转载5 years ago
AI 看唇语,在嘈杂场景的语音识别准确率高达75%

人们通过聆听和观察说话者的嘴唇动作来感知言语。那么,AI 也可以吗? 事实上,研究表明视觉线索在语言学习中起着关键的作用。相比之下,人工智能语言识别系统主要是建立在音频上。而且需要大量数据来训练,通常需要数万小时的记录。 为了研究视觉效果,…

161 0 0
[细读经典]无监督语音识别
转载5 years ago
[细读经典]无监督语音识别

这是neurips 2021的为数不多的,oral的,而且多少我能看懂一点点的一篇爽文。来自facebook AI和google AI. (这两个team在一起搞事情---有趣;看了脚注之后,知道,第三作者是在facebook AI期间参与…

60 0 0
《2020-2021中国智能语音行业白皮书》发布
转载5 years ago
《2020-2021中国智能语音行业白皮书》发布

12月18日,在中国智能语音产业发展高峰论坛暨中国语音产业联盟2021年会现场,中国语音产业联盟发布《2020~2021中国语音产业发展白皮书》(以下简称「《白皮书》」),总结这一年来智能语音行业的发展态势,把脉语音产业、指引未来走向。 智…

53 0 0