语音识别(Auto Speech Recognition, ASR)技术是一种将连续的语音信号转化为文本的技术,近年来,随着深度学习的蓬勃发展,端到端(End-to-End,E2E)语音识别技术以其简单的体系结构和优异的性能广受青睐。RNN…

最新声浪
查看全部 →日前,中国科学院自动化所(简称“自动化所”)基于全场景AI计算框架MindSpore训练完成全球首个图文音(视觉-文本-语音)三模态预训练模型(OPT-Omni-Perception pre-Trainer),该模型同时具备跨模态理解与跨模…
作者:忧郁的白衬衫 20121.07.06,GigaSpeech 重磅发布 GigaSpeech:10000小时多领域英语开源数据集发布。GigaSpeech 拥有10000小时的高质量标注音频数据和33000小时的总音频,是有史以来标注数…
语音转换(Voice Conversion)旨在保留语言内容的同时,将源说话人语音转换成目标说话人的语音。随着深度学习技术的引入,语音转换技术取得了巨大的飞跃。现有的语音转换方法可以成功地实现音色的转换,但是对源音频中的风格韵律缺乏有效的建…
由CCF语音对话与听觉专委会 、AIIA 中国人工智能产业发展联盟评估组 、北京希尔贝壳科技有限公司、语音之家(北京)科技有限公司共同主办的【语音之家】AI技术沙龙——说话人日志,将于2021年7月10号 9:30在线上直播进行。 沙龙简介…
机器智能部门语音社招岗位 [ 职位描述 ] 语音相关项目的算法研究、工程开发; 直播场景语音识别。 [ 职位要求 ] 在语音领域(识别、合成、声纹、深度学习等)方面有经验; 语音识别方向优先;至少2年(含2年)以上工作经验; 数学基础扎实,…
音频算法资深工程师/研究员 [ 职位描述 ] 应用先进的统计建模,机器学习,深度学习方法建立数据模型解决实际语音问题,如音源分离,声音事件检测,音乐信息检索,声纹识别,去噪等。 [ 职位要求 ] 计算机(机器学习、人工智能等方向)相关专业硕…
由于高效,C++被广泛应用于智能语音领域系统开发,比如知名的语音识别工具Kaldi就是由C++编写的。大多数工程师都或多或少写过C++代码,但对于C++的理解依然不深入。 最近知乎上一个“什么是C++”的视频火了,短时间内播放量超过15万。…
语音技术专家(解码器方向) [ 职位描述 ] 负责语音识别解码器的开发与性能优化; 负责语音识别解码器的前端与后端功能开发; 负责语音识别产品与应用系统的对接。 [ 职位要求 ] 本科以上学历,计算机或相关专业,3年及以上Linux下C++…
