语音识别是语音信号处理的重要研究方向之一,它是一门涉及面很广的交叉学科,与计算机、通信、语音语言学、数理统计、信号处理、神经生理学、神经心理学、模式识别、声学和人工智能等学科都有密切的联系。它还涉及到生理学、心理学以及人的体态语言。 语音识…
声浪
10 月 30 日 | 北京 LiveVideoStack 将携手阿里云共邀 4 位技术大咖,一同探讨从上云到创新,视频云的新技术与新场景。阿里云视频云依托阿里云服务数百万开发者的卓越服务能力与实践,在本专场演讲中,将从云计算服务、网络调度…
2021 云栖大会 10 月 21 日,阿里云视频云 将深度演绎一场视频云赛道的全面进化 音视频技术开创产业视频化新蓝海 新内容与新交互的演进,推动了消费端全方位的体验革新,展开了云上视频新景象,促动了众多行业音视频数智化转型,更打开了产业…
声明:工作以来主要从事TTS,VC以及ASR等等相关工作,平时看些文章做些笔记。文章中难免存在错误的地方,还望大家海涵。 平时搜集一些资料,方便查阅学习:TTS 论文列表 http://yqli.tech/page/tts_paper.ht…
前言:本文是Google于2021年9月27日发表的最新论文(10月1日更新第二版),详细介绍了Google最近一段时间在语音识别半监督领域的最新进展,包括使用一百万小时的无标签数据来训练80亿参数量的超大模型,同时还通过预训练语音识别模型…
网 易 语音算法工程师 北京 [ 岗位职责 ] 1、参与语音相关项目的算法研究与系统开发工作,具体方向包括但不限于语音识别、语音合成、声纹识别、发音评测、语音增强; 2、日常工作
前言:有感于早些年前学习语音时,在Kaldi庞大的框架和脚本里挣扎了很久,而且对于深度学习模型训练、推理、部署、优化等也困惑了很久,现如今有时间,就想实现一套最简单的自包含方案,系统的说明一套语音服务从训练到部署的全套流程,方便新人学习,也…
“前沿·探索·想象力”,今年的云栖大会即将与大家如期见面。 从10月19日至22日,云栖大会将带来100+场新思想论坛、450+最热科技新品、1000+数字新物种、40000平米的“云栖数字谷”沉浸科技体验,以及一系列炫目的极客盛会。 阿里…
