基于 SRP-PHAT 的声源定位算法
转载a year ago
基于 SRP-PHAT 的声源定位算法

在混响环境中进行说话人定位和自动跟踪是一项具有挑战性但又在众多基于音频的应用中常常需要完成的任务,例如免提手机、语音识别以及电话会议等。前面介绍的使用TDOA进行声源定位方法,在强混响或多路径环境中,互相关函数会出现多个峰值,TDOA 法可…

15 0 0
IEEE TASLP|利用LLM改进口音语音识别的多模态多粒度生成式纠错与混合LoRA专家方法
转载a year ago
IEEE TASLP|利用LLM改进口音语音识别的多模态多粒度生成式纠错与混合LoRA专家方法

语音识别(ASR)作为可以准确高效转录语音的技术,在当今社会中扮演着越来越重要的角色。当前语音识别已经取得了长足进步,但是当遇到不利语音条件时,识别错误率急剧升高。口音是说话人受到教育背景、地域或母语影响而偏离标准发音规范的情况,在现实世界…

16 0 0