阿里巴巴达摩院

阿里巴巴达摩院成立于2017年10月11日,致力于探索科技未知,以人类愿景为驱动力,开展基础科学和创新性技术研究。

阿里巴巴未来二十年的目标是为世界解决1亿就业机会,服务跨国界的20亿人口,为1000万家企业创造盈利的平台。要达到这个目标并服务世界经济,其中有无数的问题需要解决,这正是成立达摩院的初衷,并将遵循 “Research for solving problems with profit and fun” 的宗旨。

阿里巴巴创始人马云对达摩院的发展提出三个要求:“活得要比阿里巴巴长”、“服务全世界至少20亿人口”、“必须面向未来、用科技解决未来的问题”。

招聘岗位

新加坡达摩院语音组现长期招收3名Full-time语音方向研究型实习生,面向新加坡、香港、澳洲、日本、英国顶级大学的博三、博四的同学,base新加坡。实习时间3-6个月,期间专注于语音相关方向研究,研究成果可发学术顶会、期刊、专利等。

工作职责

针对会议场景语音识别和口语理解中的一些关键挑战,包括真实场景的标注数据缺乏、语音识别和口语理解在会议场景的鲁棒性、多语言的高效大规模模型训练的有效架构,开展以下的研究:

1、对语音识别任务中,真实场景的训练数据不足的问题,设计有效的语音对抗样本生成技术,同时基于数据增强和弱监督对抗训练技术提升语音识别在复杂场景下的识别准确率;

2、通过探索大规模语音识别预训练和半监督学习,提高开发训练和部署的效率和针对多语种多场景的高鲁棒性和通用性;

3、开展关于大规模多语言语音识别模型架构设计、高能效大规模模型训练、大模型多语言语音预训练模型下游任务迁移、知识融合预训练声学和语言模型等关键技术的研究,致力于设计出能容纳多种语言的大规模多语言语音识别训练模型的搭建和训练;

4、针对口语特点提升文本预训练模型的鲁棒性,并结合语音-文本联合表征的研究,提高语音识别下游的口语理解的性能。

任职要求

1. 具有良好的团队沟通能力,优秀的逻辑思维能力,对解决挑战性问题充满热情,善于解决问题和分析问题;

数据增强技术、预训练和半监督学习技术、以及语音识别模型架构技术,提升模型在复杂场景的鲁棒性和通用性。针对口语特点,通过预训练以及语音-文本联合表征技术,提升会议场景下口语理解的性能。

简历投递

邮箱主题:姓名 + 申请岗位 + 语音之家推荐

邮箱:chong.zhang@alibaba-inc.com