由CCF语音对话与听觉专委会 、中国人工智能产业发展联盟(AIIA)评估组 、58同城AI Lab、语音之家(北京)科技有限公司、北京希尔贝壳科技有限公司共同主办的【语音之家】走进企业系列沙龙-语音技术在58同城的应用,将于2021年8月3…
声浪
Facebook Al发布 Multilingual LibriSpeech(MLS),MLS提供超过50000小时的音频包含八种语言。 OpenSLR:www.openslr.org/94 Facebook Al is releasing…
写在前面 图片本文作者是斯坦福Andrew Ng的博士,比较代表性的工作包括在baidu的Deep speech/Deep speech2、在facebook的wav2letter++等,google scholar引用一万多的大佬,现在在…
经超哥同意,接下来几篇文章将转载超哥写的《Wenet网络设计与实现》。感兴趣的读者可以关注知乎杨超,同时wenet1.0正式发布( wenet1.0正式发布:更快更高更强更有生产力https://mp.weixin.qq.com/s/CG6…
智能语音是人工智能的重要分支与热门领域。随着语音识别技术的落地,智能语音已成为人与机器交互的重要方式,被广泛应用于智能手机、智能家居、智能机器人、智能汽车等智能化终端设备中。 从技术知识的角度看,语音识别具有更为典型的跨学科特点,涉及到了声…
声明:平时看些文章做些笔记分享出来,文章中难免存在错误的地方,还望大家海涵。平时搜集一些资料,方便查阅学习:http://yqli.tech/page/speech.html。如转载,请标明出处。 Dyn-ASR: Compact, Mul…
语音识别一直是一个热门的研究领域,过去几十年,语音识别技术逐步发展,识别准确率逐步上升。人们开发了不少成功的语音识别、人机交互系统。然而,在实际应用场景变得复杂的时候,许多语音识别系统更像温室里的花朵,在现实世界中性能大打折扣。 在实验场景…
每个行业都有各自要解决的特定工程问题。工程师的日常工作就是不断解决问题,最关键的能力是解决工程问题的能力,直接的体现是设计方案的优劣和方案实施的效率。要理解工程师的能力包括什么,就是说要明确以下两个子问题: 1)工程师要解决的问题是什么?…
声明:平时看些文章做些笔记分享出来,文章中难免存在错误的地方,还望大家海涵。平时搜集一些资料,方便查阅学习:http://yqli.tech/page/speech.html。如转载,请标明出处。 Streaming End-to-End…
Streaming End-to-End ASR based on Blockwise Non-Autoregressive Models 本文为Johns Hopkins University在2021.07.20更新的文章,主要使用bl…
