面向听觉智能与物理AI的
人机交互开发者社区

发现模型、参与赛事、分享实践、连接同行,共创数据、模型与评测驱动的人机交互生态。

50k+
注册开发者
5.8k+
技术文章
268+
开源数据集
300+
技术课程

最新声浪

查看全部 →
Wenet网络设计与实现2-网络结构
原创5 years ago
Wenet网络设计与实现2-网络结构

前文介绍了端到端识别的基本概念,本文介绍Wenet中模型的设计与实现。 Wenet的代码借鉴了Espnet等开源实现,比较简洁,但是为了实现基于chunk的流式解码,以及处理batch内不等长序列,引入的一些实现技巧,比如cache和mas…

333 1 0
腾讯联合北大刷新AISHELL SOTA(附代码开源)
转载5 years ago
腾讯联合北大刷新AISHELL SOTA(附代码开源)

近期,来自北京大学和腾讯AI LAB, ASR oteam的研究人员在主流端到端语音识别系统上进行了两点改进:(1)将LF-MMI准则用于端到端语音识别系统的训练和解码中;(2)使用词级别N-gram模型进行在线解码。集成上述两点的端到端模…

401 0 0
天津启阅|招聘语音识别工程师
转载5 years ago
天津启阅|招聘语音识别工程师

天津启阅 天津启阅科技有限公司是一家专业互联网高科技企业。旗下网站“飞卢中文网”运营了6年多,拥有资深编辑12名,达2万名以上的驻站作者,上千万名注册会员,月IP量900万以上,PV量达1亿以上。 其平台下飞卢中文网成立于2005年5月的飞…

196 0 0
赛思信安|招聘语音识别算法工程师
转载5 years ago
赛思信安|招聘语音识别算法工程师

赛思信安 北京赛思信安技术股份有限公司(简称赛思信安),成立于2007年,是一家专注大数据领域核心技术研发,提供优质的大数据产品与服务的高新技术企业。赛思信安在北京设有研发中心,拥有完备的软硬件研发配套设施和大数据研发团队,形成了广泛的营销…

124 0 0

为语音开发者而生