Leaderboard 项目新增基于 WenetSpeech 数据集的 WeNet 预训练模型,识别准确率如下: 具体数字如下: 该模型可与公众号之前发布的开源测试集配合使用,进行本地复现和验证,模型的下载命令为: ops/pull mod…
声浪
唤醒 熟悉Kaldi ,并且搞清当中做语音唤醒的功能 一个不错的github 资https://github.com/zycv/awesome-keyword-spotting#opensource-code https://papersw…
续上一篇文章说话人识别中PLDA的背景与训练,在这里,我进一步把PLDA的打分过程进行推演。说实话,two-covariance PLDA打分的数学部分,比训练模型部分还要复杂和困难;这部分也鲜有博客或文章去分析,但能理解一次,对于提升ba…
我们常见的PLDA,是出自《Probabilistic Linear Discriminant Analysis for Inferences About Identity》,由Simon J.D. Prince和James H. Elde…
近日,由腾讯音乐娱乐集团(TME)主办的音乐娱乐技术盛会“TechME技术周”在深圳成功举办。本次会议以“Rock N Code,让技术发声”为主题。 会议中由TME技术领域专家、音乐行业优秀技术团队和语音界大咖对技术成果进行了分享,同时共…
2021年10月15日至18日,第十六届全国人机语音通讯学术会议(NCMMSC2021)在江苏省徐州市举行。作为国内语音领域广大专家、学者和科研工作者交流最新研究成果的重要平台,NCMMSC 受到了国内语音领域的广泛关注。 会议网址:htt…
第十六届全国人机语音通讯学术会议(NCMMSC 2021)公布“长短视频多语种多模态识别挑战赛”(Video Keyword Wakeup Competition)-— 汉语长短视频直播语音关键词(VKW)任务最终成绩。 历时4个月的征集与…
赛 舵 智 能 TTS算法工程师 上海 [ 岗位职责 ] 1、负责多语种上严谨的前端+情感速度音色可控的端到端声学模型+还原度极高的声码器各个模块; 2、神经网络语音合成的速度调优-对录音数据收集工作给出指导性意见任职需求; 3、具有语音合…
数 美 科 技 算法工程师 北京/杭州 [ 岗位职责 ] 1、机器学习的算法和模型开发; 2、对机器学习尤其是深度学习前沿问题进行探索与研究,结构实际应用场景,提供全面的技术解决方案; 3、对计算机视觉、
日前,西北工业大学音频语音和语言处理研究组(ASLP Lab)、出门问问、希尔贝壳联合发布1万小时多领域中文语音识别数据集 WenetSpeech,在腾讯会议天籁实验室、华为昇思 MindSpore、 西安未来人工智能计算中心等机构大力支持…
