赛舵智能是一家位于上海的人工智能初创公司,致力于在海外市场将人工智能运用于各个国家的不同工业领域。赛舵主要聚焦语音识别、语音合成、自然语言处理和语义理解相关技术和应用,希望能够改变和简化全球人们想用科技的方式,通过提升交互体验和效率来使得生…
声浪
近年来,随着深度学习的快速发展,简单易用、性能稳定、开发高效的深度学习框架越来越被科研和工业界人员所需要。其中,TensorFlow和Pytorch则是目前深度学习的主流框架。在语音领域,基于C++开发的Kaldi工具因集成了语音相关的大量…
职位描述 1、 协助从事人工智能相关技术研究、标准制定、行业研究、评估测试、安全评测等工作; 2、协助活动和会议的组织执行,参与筹备、组织和保障各类大中型会议; 3、协助进行日常各项行政事务及服务工作; 4、日常交办的其他任务。 任职要求…
A Streaming End-to-End Framework For Spoken Language Understanding 本文为滑铁卢大学在2021.05.20更新的文章,主要做流式口语理解的工作。 具体文章链接:https:/…
文章目录 前言 语音识别原理 信号处理,声学特征提取 识别字符,组成文本 声学模型 语言模型 词汇模型 语音声学特征提取:MFCC和LogFBank算法的原理 实战一:ASR语音识别模型系统的流程基于HTTP协议的API接口客户端未来 实战…
本文是上海交大2021.05.27更新的文章,该文章主要使用GMM来进行phone-level的韵律建模,从而提高语音的自然度。该文章主要在单人,多人和prosody clone三个方面进行设计和实验,具体的文章链接 https://arx…
近日,喜马拉雅语音团队在wenet中增加了基于gRPC的流式语音识别的支持。本文将介绍wenet中的gRPC的设计和实现,并介绍喜马拉雅基于wenet和gRPC的语音识别微服务架构实践。 wenet介绍 wenet是由出门问问公司推出的一款…
本文为University POLITEHNICA of Bucharest Bucharest, Romania在2021.05.20更新的文章,主要研究领域为video-to-speech。 具体的链接:https://arxiv.or…
李沐:”博士毕业的时候曾写过我的体会,很多同学留言说深受鼓舞。现在我想同样给大家分享这五年工作中的经验和感悟。更确切说是失败的教训,因为每一点就是付出了学费后获得的教训。希望这些同样能对大家有所帮助和启发。” 作者 | 李沐 事情的价值是对…
A Streaming End-to-End Framework For Spoken Language Understanding 本文为滑铁卢大学在2021.05.20更新的文章,主要做流式口语理解的工作。 具体文章链接 : https…
