为提升课程质量,同时帮助小伙伴们解决在学习前的顾虑和学习后的疑虑,本次语音之家·工匠学堂对已上线课程《声纹识别与音频处理》进行更新。


更新要点
  1. 在原有的课程基础上,对英文的课件增加了的中文翻译字幕,降低国内学员解读和理解的成本,提高学习效率。



  2. 已更新课程答疑视频,针对高频问题以及第1~2章难懂知识点,王泉老师进行视频解答,从问题出发,以点带面,对知识点进行多方位延伸,助力学员知识点快速吸收。



声纹识别与音频处理实战课
语音之家-AI工匠学堂推出王泉老师的《声纹识别与音频处理》实战课,从最基本的声学基础和音频信号处理开始介绍,学习声纹识别技术中的基本概念和核心算法,深入理解语音和声纹的本质,所以即使是没有任何语音方面基础的同学,也可以从熟悉相关工具和代码库的使用,到实际动手搭建声纹识别系统。
课程会着重介绍基于深度学习的声纹识别系统,包括卷积神经网络、循环神经网络、注意力机制、Transformer等常用于声纹识别的神经网络结构,并对主流的深度学习声纹识别系统进行归纳总结,横向对比各种推理方法和损失函数之间的优劣,帮助大家理解所有系统的底层设计思路。
除了在讲座视频之间配备了练习题,帮助大家巩固每节课学到的内容之外,本课程还为大家准备了大量的编程题和大作业,帮助大家在实际的项目中,熟悉各种工具和代码库的使用,强化动手能力。大部分大作业配备了指导视频,手把手带领大家完成复杂的项目。


课程的最终挑战
本课程由基础和进阶两个阶段组成,每一阶段都提供了详细的指导。结合本课所学的全部内容,利用Python及PyTorch从零开始搭建一个完整的声纹识别系统。为了确保大家能够顺利完成最终的挑战,本课程将项目分解为诸多低难度的子任务,并在GitHub上提供了范例系统及其代码解读视频。

学习这门课需要哪些基础?



这门课适合人群?



讲师介绍


王泉,美国谷歌公司声纹识别与语种识别团队负责人、资深软件工程师,IEEE高级会员。本科毕业于清华大学自动化系,后取得美国伦斯勒理工学院计算机工程博士学位,曾在美国亚马逊公司参与智能音箱语音助手Alexa的研发。在谷歌任职期间,带领团队将先进的声纹技术部署到了大量产品中,使得谷歌智能音箱成为市面上第一款支持多用户模式的同类产品。在声纹识别、声纹分割聚类、人声分离、语种识别、语音检测及语音合成等诸多领域拥有大量专利,发表多篇重量级论文,工作多次被VentureBeat、TechCrunch、Engadget、CNET等国际著名科技媒体专题报道。所著《声纹技术:从核心算法到工程实践》一书荣获电子工业出版社优秀作者奖,于国外在线教育平台Udemy上开设的声纹识别英文课程被评为畅销课。


为什么要学这门课程?


课程特色


【戳我看视频】


课程大纲



全套课程服务
  • 怎么上课?在哪上课?
    报名后,请添加班主任微信(微信号15601233620)班主任会引导你按时上课。本门课程采取录播的形式,电脑/手机都能随时看课,同时配有微信学习群,授课/助教老师在线答疑解惑。
  • 我可以在任何时间学习课程吗?课程有效期是多久?
    本门课程视频总时长12小时,课程长期有效,电脑及手机端均支持反复学习。
  • 有不懂的地方,是否有专门的老师来提供帮助?
    本门课配有班主任及助教老师,班主任会督促引导你及时学习,学习中有不懂的地方助教老师在线提供帮助,同时本课程也会不定期更新答疑内容。
  • 怎么进入该课程答疑群?
    报名后,请添加班主任微信(微信号15601233620),由班主任邀请进入本门课程学习群。
  • 课程不满意,可以退款吗?
    开课学习7天内不满意可无条件退款。
  • 课程学完后,如果还需要求职帮助,怎么办?
    在你学完全部课程后,老师会为你做一份专属的学习情况总结,如果你有求职需要,可联系班主任问询。

了解更多课程相关信息
添加西西老师

👇