招聘岗位

资深音频生成工程师

招聘人数:2 人

薪资:30K-60K 15薪

职位描述

1、从事音频生成算法研究、训练、应用,包括人声、音乐、音效等方面。

2、负责模型的多机多卡训练、高性能推理等。

3、负责将生成技术落地到业务,并进行持续优化。

岗位要求

1.硕士及以上学历,计算机、数学、通信等相关专业;具备良好的学习能力、逻辑思维能力、沟通协作能力。

2.有三年及以上语音合成算法经验,或三篇及以上顶会论文(各类CCF-A会、ICASSP/INTERSPEECH等)。

3.熟练使用Python和Pytorch/Tensorflow深度学习框架。

4.对以下至少一种熟悉并有相关经验:

  • 大模型的框架&理论,包括但不限于Diffusion、Vall-E/SpearTTS/AudioLM、MusicLM、NaturalSpeech;

  • 各类声码器的原理&优化,包括但不限于Hifi-GAN,MelGAN,BigvGAN;

  • 上一代语音合成模型,包括但不限于Tacotron、Fastspeech;

5.有业务落地工程经验优先。

简历投递

邮箱主题:姓名 + 申请职位 + 语音之家推荐

邮箱:talent@zhipuai.cn

工作地点:北京,清华科技园,搜狐网络大厦