2016 年,深度学习和深度神经网络的突破使得智能语音识别的准确率第一次达到了人类水平,也促使智能语音技术进入到落地阶段。尤其是近几年,语音识别技术逐渐走向成熟,在万物互联趋势下,智能语音技术在教育、金融等各个行业落地日益深入。2020 年…
声浪
近年来服务机器人逐渐进入商场、银行、机场等场所,但多数服务机器人仅能被动响应用户的请求,且使用和交互的频率非常低,也就成为了“移动平板电脑”。 为此,百度的工程师们率先在小度机器人(DuRobot)上开展了一项技术革新。小度机器人落地于百度…
在国内,谈到智能语音技术,肯定绕不开一个人,那就是现任百度语音首席架构师贾磊,他是智能语音界举足轻重的 AI 大牛,于 2010 年加入百度,组建了百度语音团队,主导研发了百度语音识别和语音合成等一系列百度自有知识产权的语音核心技术。201…
近期,实验室王雄、姚卓远、石宪同学的论文“CASCADE RNN-TRANSDUCER: SYLLABLE BASED STREAMING ON-DEVICE MANDARIN SPEECH RECOGNITION WITH A SYLLA…
在语音识别系统中,有限加权状态转换机(Weighted Finite State Transducers, WFST)扮演着重要角色。本文主要介绍发音词典、语言模型和WFST的原理,以及在实践过程中的一些优化方法。
近日,苹果发布了头戴式耳机 AirPods Max,这也是AirPods产品线首款头戴式降噪无线耳机。今天我们来聊一聊AirPods Max的主动降噪以及空间音频技术。 据悉AirPods Max采用Apple设计的40mm动圈式驱动单元,…
过去十年,得益于人工智能与机器学习的突破、算法与硬/软件能力的进步,以及拥有既多样又大量的语音数据库,用以训练多参数的、大规模的语音识别与合成模型,使得语音处理技术获得飞跃性进展。 随着端到端神经网络在机器翻译、语音生成等方面的进展,端到端…
以BERT为代表的Transformer模型的出现是自然语言处理(NLP)领域近年来最关键的算法创新。目前互联网公司内很多线上服务系统,比如推荐系统、对话系统、翻译系统等,都使用了Transformer模型。但是由于Transformer巨…
本文将介绍语音识别框架kaldi中提出的chain model语音识别系统,文章会先介绍HMM-DNN语音识别系统以及语音识别中的区分性训练作为铺垫知识,最后再重点介绍chain model的内容。 HMM-DNN语音识别系统 1.语音识别…
