以下文章来源于阿里语音AI,作者达摩院语音实验室 ICASSP(International Conference on Acoustics, Speech, and Signal Processing)是国际声学、语音和信号处理会议,亦为I…
声浪
以下文章来源于微软研究院AI头条,作者侯汶昕、王晋东 随着深度学习的不断发展,语音识别技术得到了极大的提升,同时为人们的日常生活提供了许多便利。然而,一个语音模型的训练并非易事,因为语音数据天然存在着获取难、数据标注耗时昂贵的问题,而且还会…
由清华语音与音频技术实验室(THUsatlab)组成的THUEE队伍参加OpenASR20挑战赛取得多项语种第一名,本文主要介绍比赛中所搭建的系统。
富通科技 富通科技发展控股有限公司于2009年12月4日在香港联合交易所主板上市(香港联合交易所代码:00465.hk)。我们用近二十年的行业历程,见证中国IT盛世时代,分享全球IT华美盛宴。 富通,拥有自主研发的企业级信息产品,我们一直密…
以往神经网络模型在问答场景经常会返回一些编造的答案,实在太不靠谱了!最近DeepMind发布了GopherCite模型,教语言模型用搜索引擎,拒绝胡编乱造! 随着语言模型的参数量不断增大,生成文本的效果也越来越好。 由于训练数据中包含了海量…
关于公司 元象 XVerse(www.xverse.cn)是一家位于深圳的技术初创公司,致力于打造端云协同的 3D 内容生产与消费一站式平台,开创元宇宙(Metaverse)时代全新交互体验,以低成本、轻终端、高画质方式打造大世界,实现每个…
以下文章来源于微软研究院AI头条,作者冷燚冲、谭旭 语音识别支持着许多生活中的常见服务,比如手机端的语音转文字功能、视频网站的字幕自动生成等等。但语音识别模型往往并不完美,需要纠错模型来纠正语音识别中的错误。目前,大部分纠错模型采用了基于注…
客知音 北京智合大方科技有限公司是一家服务于企业销售和客服的前沿AI科技公司,旗下品牌客知音是国内领先的智能对话分析平台。客知音为电话销售和客服团队推出了一系列AI产品,包括智能外呼系统、智能坐席助手和AI语音质检,推动企业销售和客服智能转…
听歌识曲,我想大家都不陌生。虽然不同的厂商识别率不同(可能是因为版权的原因),但是每个音乐APP都会有这么一个功能。我们以扣扣音乐为例,扣扣音乐听歌识曲功能比较丰富,不仅有基本的听歌识曲还有哼唱识别,识别到对应的歌曲后就直接返回对应的结果,…
随着物联网技术和智能设备技术的快速发展,人与机器的交互,不再仅依赖于鼠标和键盘,更有可能的是直接采用语音。 这其中的关键技术就是自动语音识别(Automatic Speech Recognition,ASR)。其所要完成的工作,简单地说,就…
