NLP算法工程师(语音方向) [ 职位描述 ] 紧跟业界最新的技术动态,包括但不限于机器学习、深度学习、强化学习等AI相关的算法,并能够结合语音的实际业务场景提出创新的算法及模型; 参与语音合成系统前端模块的设计、开发,包括文本预处理、分词…
声浪
引子 有没有厌烦了你的语音助手声音?语气太过生硬或者一成不变语音表达?是不是期待一个真正具有人性化的助手声音,就像是电影《HER》里的萨曼莎一样,拥有迷人的声线,温柔体贴而又幽默风趣,陪伴在你左右? 图1:电影《Her》:与语音助手谈一场恋…
AGI-语音音频算法工程师(北京) 技术族/本科及以上/北京市 [ 职位描述 ] 探索大规模预训练对于声学模型和语言模型的影响; 开发基于深度学习的声学模型以及语言模型,以及针对下游任务比如唤醒词,关键词识别,语音识别对预训练网络进行微调;…
语音合成算法实习生 [ 工作职责 ] 负责语音合成相关算法的研究与开发,声学模型训练、语言模型训练的算法研究及解码器技术研发; 负责跟进行业前沿技术发展趋势,跟踪国际最新算法发展方向和相关技术,将算法与解决方案进行产品转化。 [ 职位要求…
一、岗 位 说 明 语音前端算法工程师(阵列信号处理方向) 1-3 年相关经验/25-35K/base 北京·望京 来广营 接受应届毕业生或相关研究方向实习生储备 [ 岗位职责 ] 配合公司的长期战略,研发面向未来应用的麦克风阵列语音前端算…
近日,Facebook开源了数据增强包AugLy,其中包括文本、图像、音频和视频。音频类主要以librosa、torchaudio跟numpy作为后端,具体地址:https://github.com/facebookresearch/Aug…
2021年2月19日,出门问问联合西北工业大学音频语音与语言处理研究组推出面向产品和工业界的端到端语音识别开源工具 WeNet。WeNet 自发布以来,因为其简洁性、易用性和产品优先 (Production First and Produc…
这次 WeNet 带来的更新是 U2++ 双向建模,其核心思想是同时利用标注序列的前向和后向信息训练模型,在解码时同时利用双向的 decoder 进行 re-score。实验证明,该方法在各个数据集上都能取得一致性的5%~8%的相对错误率的…
近年来,迁移学习、风格迁移、声码器、声学模型等方面的最新进展,为低资源语音克隆的提供了潜在的解决方案。爱奇艺联合西北工业大学音频语音与语言处理研究组、新加坡国立大学、清华大学深圳国际研究生院、起源智能、希尔贝壳在ICASSP2021举办了多…
