面向听觉智能与物理AI的
人机交互开发者社区

发现模型、参与赛事、分享实践、连接同行,共创数据、模型与评测驱动的人机交互生态。

50k+
注册开发者
5.8k+
技术文章
268+
开源数据集
300+
技术课程

最新声浪

查看全部 →
TIOBE 场景测试:电台节目 张震鬼故事
原创5 years ago
TIOBE 场景测试:电台节目 张震鬼故事

1、素材来源 YouTube 抓取“张震鬼故事” 往期节目,原始音频约3小时 2、场景特点 1)环境 • 播音间,周围环境安静 • 节日制作实时 & 后期混入各种配乐及恐怖音效 • 噪声非平稳,且音量较大 2)拾音设备 • 专业麦克风,近场…

111 0 0
语音识别基础(二):语音识别方法
转载5 years ago
语音识别基础(二):语音识别方法

语音识别的全程是自动语音识别(Automatic Speech Recognition,ASR),说得多了,就把“自动”省去了,认为“自动”是理所当然的了。语音识别属于序列转换技术,它将语音序列转换为文本序列。大体来说,这是一次搬运,是吧一…

105 0 0
语音识别第一讲,概述!
转载5 years ago
语音识别第一讲,概述!

1、概述 声音从本质是一种波,这种波可以作为一种信号来处理,所以语音识别的输入实际上就是一段随时简播放的信号序列而输出则是一段文本序列。将语音片段输入转化为文本输出的过程就是语音识别。 一个完成的语音识别系统通常包括信号处理和特征提取、声学…

106 0 0
OpenSpeaker 之模型转换
转载5 years ago
OpenSpeaker 之模型转换

今天我们先看一下通用的模型部署场景,然后讨论一下Libtorch模型转换。 深度学习模型部署 深度学习模型训练完成后,需要将模型部署应用,该部门一般无需再考虑如何修改训练方式或者修改网络结构以提高模型精度,更多的是需要明确部署的场景、部署方…

708 0 0
OpenSpeaker之声纹模型训练
转载5 years ago
OpenSpeaker之声纹模型训练

根据规划,今天来看第二部分模型训练: 1、声纹模型 声纹识别已有几十年的历史,但是真正的声纹模型应用,应该是从深度学习兴起之后,目前主流的声纹识别系统,也基本都是基于深度学习的方法来做的,包括经典的d-vector, x-vector, R…

391 0 0

为语音开发者而生