面向听觉智能与物理AI的
人机交互开发者社区

发现模型、参与赛事、分享实践、连接同行,共创数据、模型与评测驱动的人机交互生态。

50k+
注册开发者
5.8k+
技术文章
268+
开源数据集
300+
技术课程

最新声浪

查看全部 →
Google:借助 Live Caption 在设备上生成字幕
转载6 years ago
Google:借助 Live Caption 在设备上生成字幕

为音频内容添加字幕不仅对听障人士非常重要,也可以为所有观众提供便利。日常生活中,有多种情况是需要关掉声音看视频的,如你在乘坐公共交通工具、会议中、床上,或者身边孩子已熟睡时。研究表明,有字幕的视频会更有吸引力,使用户观看时长延长近40%。然…

9 0 0
语音识别基础:(四)前端处理
转载6 years ago
语音识别基础:(四)前端处理

模型的训练由数据驱动,有些数据是必须要准备的。为了让机器学会将语音转换为文本,首先需要给它提供大量的例子,即语音及其对应的文本,这是原始素材,也最能反映学习目的。这些数据的符号化和结构化则需要一些人类先验知识,包括语言知识和数字信号处理相关…

916 0 0
语音识别基础:(三)完整的语音识别实验
转载6 years ago
语音识别基础:(三)完整的语音识别实验

对语音识别有了大体印象,或许技术流程的细节、原理仍不是太清晰,此时大可以花些时间先行将每个知识点逐一弄明白,等到面面俱到了,这才出山,并期望有了一整套理论加持便能快速地实现一个语音识别系统。这样的线性思维适合一些考试,只要把教材的知识点摸得…

133 0 0

为语音开发者而生