招聘岗位

语音生成式AI算法研究专家

职位描述

1、负责通义实验室语音团队语音生成式算法的基础研究或/和应用落地。

2、既可以侧重于研发语音合成、语音/语种迁移转换、few-shot / zero-shot TTS、音频生成等生成类算法。还可以侧重于利用生成式范式,进一步融合语音识别、音频分析、语音增强、语音分离等更广泛的语音/音频任务。将有关算法成果应用于语音 / 音乐 / 音频生成、语音翻译(S2TT、S2ST)、数字人等众多场景中。

3、探索音频模态和语义大模型的结合,与通义千问基础模型团队协同合作,打造通义实验室含语音模态的多模态大模型,并探索在语音交互、数字人等场景的应用。

4、通过跟踪和创新,确保算法方面的行业领先。将成果通过ModelScope等开源开放平台创造研究价值,或通过转化为阿里巴巴及阿里云产品创造业务价值。

5、持续关注学术界和行业的最新研究动态,参与国际会议、研讨会,与全球顶级团队进行交流合作。

岗位要求

1、计算机科学、人工智能、语音处理、机器学习或相关领域的硕士或博士学位。

2、至少2年在语音、自然语言、图像生成、音乐生成、语音翻译、数字人或相关领域的研究研发经验。

3、熟悉深度学习、神经网络以及相关的开源工具和框架(如TensorFlow、PyTorch)。

4、具备出色的编程能力,熟练掌握Python或其他相关编程语言。

5、具备良好的团队合作精神、沟通能力以及解决问题的能力。

加分项

1、在顶级会议或期刊上发表过相关领域的论文。

2、具备实际的产品化经验,了解生成式语音AI在产品应用中的挑战。

3、有过跨领域(如自然语言处理、音频信号处理)的研究经验。

简历投递

邮箱主题:姓名 + 申请职位 + 语音之家推荐

邮箱:speech-jobs@list.alibaba-inc.com

地址:北京/杭州