目前在语音领域市场上的产品大多都是落地在家居和车载场景上,两大场景的数据又是怎么制作和标注后应用到实际系统上的呢?今天我们拿场景数据制作案例来实际分析下。
案例一:家居场景语音数据
语音识别产品落地场景位家居室内环境,那就是智能家电和生活电子产品。定位好产品后就要制作语料,例如:你好,空调。家居环境里因为还要分析具体的产品应用场合,所以要考虑录制点的布局和距离的控制。距离和高度的会有不同的数据产生,混响、噪音等都会以不同程度出现。
在一个客厅我们采集空调、电视、控制器这三个点位的语音数据,设计好语料和布置好点位、距离就可以进入采集了。这个时候一个问题来了,用什么设备采集?采集的设备基本分为三类,第一类是设计的产品原型、第二类是高保真麦克风、第三类是ios、android系统的移动设备。这三类可以同时使用也可以搭配和单一布置。
进入录制环节后就是人的问题了,需要有足够的资源来不断的录制语料,按照一个稳定的进度来保证数据量的产出。数据录制后的工作就是标注环节了,这个环节相对单一。如果是有文本的数据,先通过工具平台识别检测出高度匹配内容,剩下的人工校对修改。这样得到的结果就是一套完整语音加标注的数据集。
案例二:车载场景语音数据
车载场景同样要分析落地的产品应用,车机、后视镜、方向盘等。制作的流程和家居一样,选定语料、布置点位和距离、设备选定、录制人员到位、数据标注。
和家居场景不同的是车载是一个移动多变的场景,需要考虑车速、车窗开关、音乐开关、前后排、发动机开关、天气、路况等的变化带来的不同语音数据。所以车载的语音收集是个多变化的组合工程。

最后希望今天分享的内容能给大家带来些帮助,谢谢。
