分享嘉宾:陆昱博士追一科技 算法工程师 编辑整理:吴祺尧 出品平台:DataFunTalk 导读:今天和大家分享的主题是基于文本和语音的双模态情感分析。大家可能会从自然语言处理的角度认为情感分析已经做得比较成熟了,缺少进一步研究的方向。此外…
声浪
语音合成(Speech Synthesis)是指赋予机器像人一样开口说话的能力,是实现自然人机交互的重要一环。语音合成除了在语音交互中充当机器嘴巴的能力之外,还在AI有声朗读、障碍语音恢复等任务中具有重要应用。语音合成的应用场景包括语音助手…
本次分享ICML 2021会议中一篇语音合成的佳作《Conditional Variational Autoencoder with Adversarial Learning for End-to-End Text-to-Speech》(A…
字节跳动智能创作语音团队SAMI(Speech, Audio and Music Intelligence)近日上线一项高保真、低延迟、高并发歌唱合成技术。该技术在兼顾保真度和速度上实现了一定的突破:一方面,AI模型可以模拟人类独特的音色、…
本次分享日本名古屋大学Tomoki Toda教授、国立台湾大学李宏毅教授和卡内基梅隆大学Shinji Watanabe教授三位大佬合作投稿于ICASSP2022的论文《S3PRL-VC: Open-source Voice Conversi…
Short-Course Proposals Submission Deadline:7 January 2022 Short-Course Acceptance Notification:12January, 2022 The IEEE…
小时候的游戏 小时候,我热衷于一类数字游戏,在一堆数字里寻找规律。 比如:1,1,2,3,5,8,13, __?. 答案是 21。所有数字都满足规律:「第三个数字等于前两个数字之和」。 而这个乐于寻找规律的习惯,似乎一直在伴随着我的成长。即…
本文总结于西工大音频语音与语言处理实验室(ASLP@NPU)负责人-谢磊教授在深蓝学院的公开课——智能语音技术的新进展与发展趋势—NPU-ASLP视角。 大家好!感谢深蓝学院的邀请!我代表西工大音频语音与语言处理研究组向各位汇报一下我们实验…
这是neurips 2021的为数不多的,oral的,而且多少我能看懂一点点的一篇爽文。来自facebook AI和google AI. (这两个team在一起搞事情---有趣;看了脚注之后,知道,第三作者是在facebook AI期间参与…
本文将为大家介绍「如何使用Adapter(适配器)结构、基于元学习和迁移学习思想对预训练语音识别(ASR)模型进行跨语言的迁移」。在这项工作中,我们主要研究了如何利用Adapter进行高参数效率(parameter-efficient)的预…
