我的资源
共 246 个数据集
ALFFA
Speech Recognition
ALFFA

African Languages in the Field: speech Fundamentals and Automation

0 下载 · 0 赞获取 →
Vystadial
Speech Recognition
Vystadial

这些数据是转录的以英语和捷克语交流的电话数据。

0 下载 · 0 赞获取 →
Aidatatang_200zh
语音识别声纹识别
Aidatatang_200zh

基于完整数据集精选的200小时中文普通话语音数据集

0 下载 · 0 赞获取 →
AISHELL-语音唤醒词数据库
语音识别唤醒词
AISHELL-语音唤醒词数据库

时长:437.67小时

2 下载 · 0 赞获取 →
AISHELL-家居环境近远讲同步语音数据库
语音识别测试
AISHELL-家居环境近远讲同步语音数据库

AISHELL-2019A-EVAL 随机抽取 50 个发音人。每人从位置 A(高保真 44.1kHz,16bit)与位置 F(Android 系统手机 16kHz,16bit)中,各选取 232 句到 237 句。

1 下载 · 0 赞获取 →
AISHELL-翻译机录制语音数据库
语音识别测试
AISHELL-翻译机录制语音数据库

来自AISHELL的开源语音数据产品:翻译机录制语音数据库

2 下载 · 0 赞获取 →
AISHELL-2
语音识别测试
AISHELL-2

希尔贝壳中文普通话语音数据库AISHELL-2的语音时长为1000小时,其中718小时来自AISHELL-ASR0009-[ZH-CN],282小时来自AISHELL-ASR0010-[ZH-CN]。

2 下载 · 0 赞获取 →
AISHELL-1
Speech Recognition
AISHELL-1

AISHELL是由北京希尔公司发布的一个中文语音数据集,其中包含约178小时的开源版数据。

0 下载 · 0 赞获取 →
MAGICDATA Mandarin Chinese
Speech Recognition
MAGICDATA Mandarin Chinese

语料库包含755小时的语音数据,其主要是移动终端的录音数据。邀请来自中国不同重点区域的1080名演讲者参与录制。

0 下载 · 0 赞获取 →
THCHS30
语音识别带kaldi例子
THCHS30

大约40小时的中文语音数据,内容以文章诗句为主,全部为女声。

0 下载 · 0 赞获取 →
Primewords Chinese Corpus Set
Speech Recognition
Primewords Chinese Corpus Set

该语料由296名以中文为母语的人的智能手机录制。转录精度大于 98%,置信度为 95%。

0 下载 · 0 赞获取 →
Free ST Chinese Mandarin Corpu
语音识别说话人识别
Free ST Chinese Mandarin Corpu

它有855个speakers。每个演讲者有120个话语。所有的话语都经过人仔细的转录和核对。

0 下载 · 0 赞获取 →