
趣丸科技团队介绍
我们的优势:
1. 我们研发拥有来自各大厂相关算法领域名列前茅的多位专家(Bigo, 网易, 字节, 虎牙, YY等),并且我们的技术社区氛围非常好,乐于分享和交流,每年还有2次技术攻坚项目激励,年度专利挖掘辅导。
2. 我们公司业务在语音识别需求上量大,每日平均拥有超过20万小时审核时间,同类业务当量全国最大,体量大舞台大,并且已覆盖多个业务,形成端云协同处理链路
3. 该岗位在公司业务为核心岗位,是生存的必要之根本诉求,长期且稳定
岗位一:语音算法工程师(业务方向)
岗位职责
1. 负责语音识别声学/语言模型的算法研究,模型训练以及优化;
2. 根据线上反馈对语音识别结果进行改进和优化,提升识别性能;
3. 根据最新的开源框架或者论文,配合算法研究员搭建训练和测试环境;
4. 跟踪业界最新研究方向,能独立做baseline仿真,尤其是端对端语音识别系统开发;
职位要求:
1. 本科学历以上,计算机、模式识别、语音信号处理等相关专业,3年以上工作经验;
2. 熟悉linux平台开发,熟练掌握python、c++/c、matlab至少一种语言,具有实际项目开发经验;
3. 了解语音识别相关原理和框架,例如kaldi,wenet, RNNT, whisper等;
4. 有基于深度学习框架下训练或者开发的经验,比如TensorFlow、PyTorch、Caffe等;
5. 有较强的沟通和团队协作能力;
加分项:
1. 根据语音识别算法研究原型,实现对应的可上线服务(ASR 组件开发)
2. 有语音识别、NLP和大数据分析平台等相关方面实操经验(参与过线上产品开发)
岗位二:语音大模型算法
岗位职责:
负责端对端语音大模型等方向上技术的研究与开发。包括但不仅限于声音克隆、zero-shot语音合成、文生语音、语音转换、ASR等;
负责端对端语音大模型的业务场景应用和效果优化;
调研和复现业界先进的技术框架,提升自研模型的效果和推理性能;
任职资格:
1、要求人工智能、计算机类、数学类,信号处理等相关专业,三年以上相关工作经验,硕士及以上;
2、熟练掌握C/C++/python,较强的编码实现能力;
3、熟练使用tensorflow/pytorch至少一种深度学习框架,理解深度学习基础理论,有相关平台算法项目经验;
4、精通深度学习、大模型训练、音频信号处理等领域的基础技术与原理,熟悉SeedTTS、ChatTTS、CosyVoice、SenseVoice等模型和技术;
5、对岗位所述方向有强烈的兴趣,自驱并敢于挑战,性格开朗,有合作精神;
6、具有语音大模型实际项目经验优先;
加分项:
在相关国际会议或主流期刊上发表论文者优先(ICASSP,Interspeech,ASRU)
岗位三:多模态语音算法(All Voice Lab)
岗位职责:
1、承担在语音大模型等方向上技术的研究与开发。包括声音克隆、zero-shot语音合成、文生语音、语音翻译、ASR、音效生成等。
2、承担背景音分离、降噪、说话人识别、VAD等语音基础技术的研发与工程化。
3、负责相关算法在移动端、PC端、云端等场景的产品化落地。
任职条件:
1.要求人工智能、计算机类、数学类等相关专业,三年以上相关工作经验,博士优先;
2.精通深度学习、大模型训练、音频信号处理等领域的基础技术与原理,熟悉SeedTTS、ChatTTS、CosyVoice、SenseVoice等模型和技术;
3.熟练掌握Python/C/C++语言,数据结构和算法基础扎实,了解CUDA开发和TensorRT;
4.熟练掌握Tensorflow、Caffe、pytorch等任一种深度学习框架。
工作地点:广州
联系人邮箱:huhuimin@52tt.com
