多情感语音编辑数据集ECD-TSE现已开放下载!
内蒙古大学S2LAB刘瑞教授联合美国约翰霍普金斯大学、美国卡耐基梅隆大学、香港中文大学(深圳)等单位推出了首个面向情感一致性建模的多情感语音编辑数据集——ECD-TSE。该数据集大约90小时,涉及到5种情感,涵盖11个主题内容,总计84,0…
13 0 0
内蒙古大学S2LAB刘瑞教授联合美国约翰霍普金斯大学、美国卡耐基梅隆大学、香港中文大学(深圳)等单位推出了首个面向情感一致性建模的多情感语音编辑数据集——ECD-TSE。该数据集大约90小时,涉及到5种情感,涵盖11个主题内容,总计84,0…
声纹识别是语音领域一个重要的问题,一个鲁棒性强的声纹模型也能够让许多下游任务(语音分离,说话人日志等)受益。然而,声纹识别一个重要的痛点在于说话人人数的多少,这也间接影响着语种,信道的多样性。为了丰富开源语音语料库,为训练声纹大模型提供强有…
目前已解锁场景: • SPEECHIO_ASR_ZH00000 :Leaderboard 调试集(经济、货币、金融) • SPEECHIO_ASR_ZH00001 场景:新闻联播 • SPEECHIO_ASR_ZH00002 场景:鲁豫有约…
人们常常说,在熬过了数十年寒冬,2020 -2021 我们终于迎来了本土开源的拐点,国家政策的引导、基础软件的崛起、开放协作精神的觉醒……各种各样的数据报告也无一不支撑着这一观点。 GitHub 2015 - 2020 年事件日志量、活跃仓…