来源丨https://zhuanlan.zhihu.com/p/531934889 作者丨孙思宁 本文主要基于我们之前发表的论文“Tiny Transducer: A Highly-Efficient Speech Recognition…
声浪
趣丸科技 趣丸科技成立于2014年,是一家集兴趣社交、电子竞技、互动娱乐等业务于一体的创新型科技企业。 随着公司的快速发展,团队规模已超1000人,聚焦Z世代用户群体,布局极具潜力的业务赛道,趣丸科技致力于连接全球10亿玩家,打造文化生活新…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音5篇,eess.AS音频处理6篇。 cs.SD语音 【1】 Machine-learning applied to classify flow-induced sound paramete…
一年一度的全球语音大会INTERSPEECH 2022论文评选结果已经揭晓,我们的论文I《KaraTuner: Towards end to end natural pitch correction for singing voice in…
来源丨作业帮语音技术团队 作者 | 王伟戌 王强强 在深度学习火爆的今天,大规模数据下训练的大规模模型在线上任务中日益常见。随着大模型效果的提升,随之带来了一些使用上的不便。通常情况下,大模型需要基于大量语料、文本训练,迭代周期长。且对于特…
元象 XVERSE 元象 XVerse(www.xverse.cn)是一家位于深圳的技术初创公司,致力于打造端云协同的 3D 内容生产与消费一站式平台,开创元宇宙(Metaverse)时代全新交互体验,以低成本、轻终端、高画质方式打造大世界…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音10篇,eess.AS音频处理10篇。 cs.SD语音 【1】 Position Prediction as an Effective Pretraining Strategy 标题:职位…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音14篇,eess.AS音频处理14篇。 cs.SD语音 【1】 Masked Autoencoders that Listen 标题:可监听的蒙面自动编码器 链接:https://arxi…
文章来源于音频语音与语言处理研究组,作者杨展恒 作为语音识别领域的一项典型任务,语音指令识别(Speech Command Recognition,SCR)是一种从连续的音频流中检测出预定义的命令的技术。SCR技术已经被广泛应用于计算资源受…
今天跟大家分享一篇语音相关的论文合集:cs.SD语音13篇,eess.AS音频处理14篇。 cs.SD语音 【1】 Lip-Listening: Mixing Senses to Understand Lips using Cross Mo…
