招聘岗位

音乐大模型算法实习生

职位描述
1.负责音乐理解、音乐生成相关大模型的算法研究,包括(但不限于)将各种音乐理解及生成任务如音乐类型分类、音乐分离、自动音乐转录、歌词转录、音乐信息(如作曲家/歌曲名/音乐描述等)提取、歌词生成、歌词到旋律生成、伴奏生成/旋律配伴奏、多模态音乐生成、音乐编辑等等功能集成到一个统一的音乐大模型中。

2.推动上述研究成果落地。

3.完成相关论文的撰写和相关专利的申请。

岗位要求
1.硕士及以上在校生,计算机科学或相关专业,特别优秀的本科生也可考虑。

2.扎实的数理、算法基础和工程实现能力,精通Python,熟悉使用Pytorch编写模型和数据处理流线,会使用如Deepspeed等优化加速工具对模型进行性能调优。

3.对语音领域有一定基础,熟悉现有常用的大模型框架及大模型的训练/微调方法,有一定的音乐基础(如音乐理论),会至少一门乐器者优先。

4.熟悉网页搭建,如gradio框架搭建网页示例来展示模型性能。

5.有论文发表经验,在相关国际会议或期刊(ICASSP/Interspeech/TASLP/ICME/ACMMM/ISMIR/NeurIPS/ICML/ICLR/CVPR/ICCV/ECCV)等发表过学术论文者优先。

简历投递

邮箱主题:姓名 + 申请职位 + 语音之家推荐

邮箱:shansongliu@tencent.com

工作地点:北京/深圳,北京优先