为了进一步丰富开源语音语料库,促进语音语言处理技术的发展,Magic Data联合中科院声学研究所、上海交通大学和西北工业大学,在Magichub开源社区正式开源180小时中文对话式语音数据集MagicData-RAMC。MagicData…
声浪
近日,由全球语音技术顶尖会议INTERSPEECH 2022举办的会议场景下非侵入式客观语音质量评估挑战赛成绩正式公布,快手音视频技术团队在包括皮尔逊相关系数(pearson correlation coefficient,PCC)和均方根…
随着科技的发展,越来越多的具有科技感的可穿戴设备以各种丰富多样的形态涌入人们视野,常见有智能手环、智能手表、VR眼镜等。按照穿戴部位的不同,主要可分为头颈类、上肢类、躯干类、下肢类四大类,不管是哪一类的智能穿戴设备都和声学技术紧密相关,那么…
今天与大家分享一本介绍语音合成原理和针对汉语的各项合成技术及应用的书。 《汉语语音合成—原理和技术》 吕士楠 初敏 许洁萍 贺琳 著 本书介绍语音合成的原理和针对汉语
本次分享韩国科学技术高级研究院 Korea Advanced Institute of Science and Technology (KAIST) 在InterSpeech2021发表的表现力语音合成论文《STYLER: Style Fa…
语音合成 (Text-to-speech, TTS) ,作为一种当前火热的AI生成任务,又称文语转换,是服务于语音交互、信息播报、有声朗读等任务的核心技术。在深度学习的推动下语音合成的自然度和音质得到了极大的提升。然而,人类语音不仅承载语言…
今天我们要将3A算法中最难的一个算法,也是WebRTC流程解析这个系列的最后一个算法,声学回声消除(Acoustic Echo Cancellation,AEC )。如果读者对WebRTC有一些了解的话,就知道WebRTC的AEC算法大致可…
以下文章来源于阿里语音AI,作者乔刚,鲁路,田彪 4月7日,AI基准测试 MLPerf™ Tiny Benchmark结果公布,阿里巴巴在嵌入式语音唤醒场景中提交的方案较好地平衡了推理任务中的准确率与延时,保证准确率90.7%情况下耗时最短…
AI语音生成的特点就是呆板,没有情绪的起伏。最近Meta AI连发了三篇Textless NLP的论文,不仅开源了textlesslib库,还展示了AI对话在语音情感转换的惊人能力!
本文中,包括刘知远、唐杰、孙茂松等在内来自清华大学的研究者对大模型的参数高效微调进行了全方位的理论和实验分析。 来源丨机器之心 预训练语言模型 (PLM) 已经毫无疑问地成为各种 NLP 任务的基础架构,而且在 PLM 的发展中,呈现出了一…
