
由清华语音与音频技术实验室(THUsatlab)组成的THUEE队伍参加OpenASR20挑战赛取得多项语种第一名,本文主要介绍比赛中所搭建的系统。








在基于传统混合系统进行低资源语音识别时需要综合考虑各方面配置与改进,包括声学模型,语言模型,数据增强,数据清洗等,此外集外词的处理对于系统整体性能提升会有较大帮助,值得进一步探索。 借助预训练模型进行低资源小语种语音识别可取得更优性能,利用目标语种的相关音频资源、使用合适的预训练表征、设计合理的下游模型结构则可以进一步降低词错误率。

由清华语音与音频技术实验室(THUsatlab)组成的THUEE队伍参加OpenASR20挑战赛取得多项语种第一名,本文主要介绍比赛中所搭建的系统。







