资深音频算法工程师
1、从事音频生成算法研究、训练、应用,包括人声、音乐、音效等方面。
2、负责模型的多机多卡训练、高性能推理等。
3、负责将生成技术落地到业务,并进行持续优化。
1.硕士及以上学历,计算机、数学、通信等相关专业;具备良好的学习能力、逻辑思维能力、沟通协作能力。
2.有一年及以上语音合成算法经验,或者一年以上语音识别经验且希望转生成方向。
3.熟练使用Python和Pytorch/Tensorflow深度学习框架。
4.熟悉以下至少一种,且有相应研发经验优先:
大模型的框架&理论(如Diffusion、Vall-E/SpearTTS/AudioLM、MusicLM、NaturalSpeech等);
各类声码器(如Hifi-GAN,MelGAN,BigvGAN等);
上一代语音合成模型(如Tacotron、Fastspeech等);
有顶会论文(各类CCF-A会、ICASSP/INTERSPEECH等)优先。
邮箱主题:姓名 + 申请职位 + 语音之家推荐
工作地点:北京

