1、负责音频语音等预训练大模型算法和数据生态的研发。
2、负责语音合成应用技术产品化效果和效率的持续优化。
3、负责跟进业界前沿算法发展方向,持续优化通用类生成效果。
1、面向计算机、语音信号、数学或统计学等相关专业的硕士及以上学历。
2、熟悉常用语音合成算法,如FastSpeech、Tacotron、Vits、HifiGAN等。
3、熟悉Textless GSLM、AudioLDM、VallEX、XTTS等主要大模型算法。
4、熟练使用Pytorch/Tensorflow框架,扎实的Python/C/C++编程功底,落地经验者优先。
5、较强的自学能力和独立思考能力,善于思考和表达自己的想法,同时又具备良好的团队合作精神。
6、(实习):一周至少4天的实习时间,实习时间不少于三个月。
1、负责面向社交场景的实时语音通话技术体系的探索和研发。
2、负责面向数字人的语音驱动表情动画技术的探索研发。
3、负责跟进业界前沿交互技术的发展趋势和制定新的端云交互体系。
1、面向计算机、语音信号、数学等相关专业的硕士及以上学历。
2、熟悉端点检测/声纹识别/语音唤醒/分离/识别/语言处理/对话系统等流程,有实践应用背景。
3、熟悉Kaldi,Wenet,TensorFlow、Pytorch至少一种框架,熟悉C++/Pytho开发语言。
4、熟悉或了解语音驱动数字人动画相关技术,有一定基础经验,了解视觉和数字人等基础知识。
5、较强的自学能力和独立思考能力,善于思考和表达自己的想法,同时又具备良好的团队合作精神。
6、(实习):一周至少4天的实习时间,实习时间不少于三个月。
1、负责音乐端到端大模型算法和数据体系的探索和研发。
2、负责AI作词/作曲/编曲/混音/特效等算法的探索和研发。
3、负责跟进行业前沿技术发展趋势,支持公司通用类音乐生成效果持续优化。
1、计算机、音乐、信号处理、通信、数学等相关专业的硕士及以上学历。
2、具备一定的音乐乐理知识,热爱音乐,对AI音乐生成算法具有强烈兴趣。
3、熟悉或了解suno Chirp、Google MusicLm 以及DPM Diffusion等相关算法。
4、熟练使用Pytorch/Tensorflow框架,有Python/C/C++编程功底,有落地经验者优先。
5、有声音音效开发、音频音乐内容理解、词曲生成等相关项目经历者优先。
6、较强的自学能力和独立思考能力,善于思考和表达自己的想法,同时又具备良好的团队合作精神。
7、(实习):一周至少4天的实习时间,实习时间不少于三个月。
邮箱主题:姓名 + 申请职位 + 语音之家推荐

