字节跳动成立于2012年3月,公司使命为“Inspire Creativity, Enrich Life(激发创造,丰富生活)”。公司业务覆盖150个国家和地区、75个语种,拥有超过6万名员工。

字节跳动在全球推出了多款有影响力的产品,包括今日头条、抖音、西瓜视频、飞书、TikTok、Lark、Helo等。截至2020年1月,字节跳动旗下产品全球月活跃用户数超过15亿。

招聘岗位
音频算法工程师(抖音智能对话机器人)
岗位职责

1、负责为抖音客服业务VOIP和热线等语音交互场景提供专业的音频技术支持与研发,运用端到端的语音大模型实现更高效、智能的客服音频交互体验;

2、负责端到端语音大模型在客服应用中的落地与优化,搭建智能音频理解和处理在客服领域的系统级解决方案;

3、跟进客服产品业务的语音/音频需求,持续改进产品的音频质量体验;结合实际业务场景,对模型进行针对性训练和调优,确保语音识别、合成等功能能精准适配客服对话需求,提升对话理解和回复的准确性;

4、跟踪研发业界先进的音频进展,探索语音/音频领域最新技术的研发并落地产品。

岗位要求

1、深入理解端到端语音大模型的原理和架构,熟悉常见的语音大模型,如Whisper等,对语音识别、合成、对话理解等技术有扎实的理论基础;

2、具备优秀的编程能力,熟练使用Python等主流编程语言,熟悉深度学习框架,如PyTorch或TensorFlow,能够进行模型的开发、训练和部署;

3、有语音大模型实际应用项目经验,特别是在音频通信、客服系统等领域,有相关经验者优先;

4、在语音处理、人工智能相关领域的高水平会议和期刊,如ICASSP、Interspeech等发表过论文,或在相关竞赛中取得优异成绩者优先。

简历投递

内推链接:

地址:北京、深圳、上海