面向听觉智能与物理AI的
人机交互开发者社区

发现模型、参与赛事、分享实践、连接同行,共创数据、模型与评测驱动的人机交互生态。

50k+
注册开发者
5.8k+
技术文章
268+
开源数据集
300+
技术课程

最新声浪

查看全部 →
语音识别-中英混ASR案例
转载5 years ago
语音识别-中英混ASR案例

首先语音识别系统对收集到的目标语音进行预处理,这个过程就已经十分复杂,包含语音信号采样、反混叠带通滤波、去除个体发音差异和设备、环境引起的噪声影响等等。之后对处理的语音进行特征提取。 语音识别的原理其实并不难理解,原理上和指纹识别的原理相同…

402 0 0
基频提取算法综述
转载5 years ago
基频提取算法综述

音高(pitch)是声音的三大属性(音量、音高、音色)之一。除去个别极端情况,音高是由声音的基频(fundamental frequency, 简记为)决定的,因此在文献中「音高」与「基频」两个词常常混用。由有规律的振动发出的声音,一般都会…

84 1 0
用 WeNet 搭建 Android 语音识别系统
原创5 years ago
用 WeNet 搭建 Android 语音识别系统

WeNet 是出门问问联合西北工业大学推出端到端语音识别工具,并且开源在 Github 上。为了方便大家使用,本文将教大家如何在 Android 手机中构建一个语音识别系统。 本文的示例运行环境如下所示: CPU (Intel x86_64…

445 0 0
语音合成和语音识别资料查询说明
转载5 years ago
语音合成和语音识别资料查询说明

文章转载请标明出处:微信公众号 低调奋进 个人网站http://yqli.tech/本来整理语音合成相关的文章、数据以及开源工具等等。现在,我对资料进行整理,添加了语音识别模块,在这里分享给大家,节省读者查找资料的时间。接下来,我给大家详细…

467 0 0

为语音开发者而生