面向听觉智能与物理AI的
人机交互开发者社区

发现模型、参与赛事、分享实践、连接同行,共创数据、模型与评测驱动的人机交互生态。

50k+
注册开发者
5.8k+
技术文章
268+
开源数据集
300+
技术课程

最新声浪

查看全部 →
百万小时无监督数据上训练80亿参数模型,多项语音任务上SoTA,语音的ImageNet时刻?(一)
转载5 years ago
百万小时无监督数据上训练80亿参数模型,多项语音任务上SoTA,语音的ImageNet时刻?(一)

0、摘要 本文总结了使用大型自动语言识别(ASR)模型进行的大量工作的结果,这些模型使用了包含大约一百万小时音频的无标签数据集进行预训练。作者发现,预训练、自监督训练和增大模型大小这三种方法的结合可以极大地提高数据有效利用率,即使对具有数万…

762 1 0
唤醒词录制采集案例
转载5 years ago
唤醒词录制采集案例

随着人工智能和大数据技术发展,语音识别技术凭借成本与算法复杂程度低、算力强等优势,在车载系统、机器人、家庭服务、银行、医疗、工业控制等领域得到越来越广泛的应用。 语音唤醒词是触发交互设备唤醒功能的语音口令,语音唤醒是指用户通过说出预设唤醒词…

221 1 0
语音识别-贵州话-short8转写
转载5 years ago
语音识别-贵州话-short8转写

语音识别的研究工作对于信息化社会的发展,人们生活水平的提高等方面有着深远的意义。随着计算机信息技术的不断发展,语音识别技术将取得更多重大突破,语音识别系统的研究将会更加深入,有着更加广阔的发展空间。语音识别是解决机器“听懂”人类语言的一项技…

226 0 0

为语音开发者而生