华为诺亚方舟实验室语音语义团队与海思、云BU等团队合作,共同研究大规模预训练模型的训练技术,发布了自己的中文预训练语言模型NEZHA(NEural ContextualiZed Representation for CHinese LAng…
声浪
Unsupervised Cross-lingual Representation Learning at Scale 作者:Alexis Conneau、Kartikay Khandelwal 等(Facebook AI) 论文地址:ht…
智能音箱往往承担着智能家居中枢的任务,所以一旦控制了音箱,实际也就控制了整个智能家居。 天猫精灵,来首周杰伦的歌; 小度小度,明天7点叫我起床; 小爱同学,今天天气怎么样; …… 现如今,随着智能音箱价格越来越低、内容越来越丰富、功能越来越…
导读:本文将介绍58同城人机语音对话机器人的完整解决方案,重点分享对话策略管理、自动电话拨打、意图识别、防骚扰控制等核心模块的设计实现,并阐述如何将语音机器人应用于58各业务场景,以助力销售、运营和客服提高人效。 ——背景—— 58同城是中…
导读:目前为止 IT 产业经历了六次浪潮,分别为:大型机时代,小型机时代,个人电脑时代,桌面互联网时代,移动互联网时代和 AIOT 时代。在这些时代背后可以发现是人机交互方式的变化:从鼠键交互,到触控交互,再到语音智能交互,可以看到人机交互…
导读:在过去的20年中,互联网把人们带入了一个全新的时代。在这个全新的时代,我们创造出了4种连接方式:人和物品之间的连接;人与人之间的连接;人和信息之间的连接;人和设备之间的连接。 但连接不是目的,它只是为交互提供相应的服务。对我们每一个人…
摘要:基于神经网络端到端的文本到语音合成(TTS, Text to Speech)在近年来发展迅速,受到了学术界和工业界的广泛关注。然而,数据和计算资源往往制约着TTS在实际场景中的广泛应用,如何构建低资源场景下的TTS系统是一个难题。 分…
【导读】OpenAI终于发布最大版本15亿GPT-2参数!生成一本《哈利波特》不在话下!作为GPT-2的最终模型分阶段发布,发布最大版本的GPT-2(15亿参数)以及代码和模型权重,以方便检测GPT-2模型的输出。此前因担心史上最强NLP模…
语音识别技术在各种工业应用中获得了极大的普及。但是,建立一个好的语音识别系统通常需要大量的转录数据,而这些数据收集起来成本高昂。为了解决这个问题,来自滴滴出行人工智能实验室的研究者提出了一种新颖的无监督预训练方法,他们称之为 masked…
