活动与赛事

INTERSPEECH 2023 论文预讲会第五期邀请到上海师范大学进行专场分享,欢迎大家预约观看。

INTERSPEECH 2023 论文预讲会邀请到上海交通大学X-LANCE跨媒体语言智能实验室在6月28日、7月5日分别做两期专场分享,欢迎大家预约观看。

INTERSPEECH 2023 论文预讲会第二期邀请到华南理工大学专场分享,欢迎大家预约观看。

Welcome to our exciting workshop on deep learning in music and audio processing! This event brings together some of the most renowned researchers from around the world to discuss the latest advances in music AI and computational audio processing.

目前ACL 2023的论文录用结果公布,火山语音团队多篇论文成功入选,内容涵盖音频合成、歌声合成以及语音翻译等多个技术领域的创新,通过本次线上沙龙活动可以更细致了解这些前沿技术突破。

INTERSPEECH 2023 论文预讲会第一期邀请到清华大学和新疆大学进行联合专场分享,欢迎大家预约观看。

ICASSP 2023 论文预讲会第九期邀请到天津大学天津市认知计算与应用重点实验室做本次会议的专场分享,欢迎大家观看。

ICASSP 2023 论文预讲会邀请到西北工业大学音频语音与语言处理研究组(NPU-ASLP)在5月23日、5月24日分别做两期专场分享,本文介绍第二场相关内容,欢迎大家预约观看。

ICASSP 2023 论文预讲会邀请到西北工业大学音频语音与语言处理研究组(NPU-ASLP)在5月23日、5月24日分别做两期专场分享,本文介绍第一场相关内容,欢迎大家预约观看。

ICASSP 2023 论文预讲会邀请到新加坡南洋理工大学的信号处理实验室(DSP Lab)在5月16日做专场分享,欢迎大家预约观看。

ICASSP 2023 论文预讲会第五期邀请到香港理工大学(PolyU)做本次会议的专场分享,欢迎大家观看。

ICASSP 2023 论文预讲会邀请到昆山杜克大学语音及多模态智能信息处理实验室在5月14日做专场分享,欢迎大家预约观看。

ICASSP 2023 论文预讲会邀请到清华大学人机语音交互实验室(THUHCSI)在5月11日、5月12日分别做两期专场分享,本文介绍第二场相关内容,欢迎大家预约观看。

ICASSP 2023 论文预讲会是由CCF语音对话与听觉专委会、语音之家主办,旨在为学者们提供更多的交流机会,更方便、快捷地了解领域前沿。活动将邀请 ICASSP 2023 录用论文的作者进行报告交流。

ICASSP 2023 论文预讲会是由CCF语音对话与听觉专委会、语音之家主办,旨在为学者们提供更多的交流机会,更方便、快捷地了解领域前沿。活动将邀请 ICASSP 2023 录用论文的作者进行报告交流。

三星电子中国研究院在ICASSP2023上共有8篇论文被接收,涉及多种信号处理,包括音频、文本、图像、视频、多模态等,从声音分离、音频事件检测、文本预训练、人脸检测、图像语义分割、频编解码及身份识别等多个任务上探索前沿技术。除此之外,三星电子中国研究院还在首届e-Prevention challenge中获得第一名。在本次沙龙中,三星语言智能团队将对其中语音文本以及多模态信号处理方面的成果进行分享。

帝国理工和Meta合办的增强现实语音增强挑战赛SPeech Enhancement for Augmented Reality challenge (SPEAR)将在2023年3月30号举办线上论坛,欢迎大家参加!

SCI 期刊Applied Science (影响因子 2.838) 近日发布了专刊“Advanced Technology in Speech and Acoustic Signal Processing”,欢迎各位同仁赐稿。

NVIDIA NeMo是一个用于构建对话式人工智能应用的自动语音识别工具库。它采用语音文本数据为输入,并使用人工智能和自然语言处理模型理解语义,从而实现语音与文字间内容的相互转换。NeMo toolkit可用于构建人机语音文字交互的对话式解决方案,用于搭建智能语音助手,聊天机器人,智能语音翻译 ,声控智能家居及无人驾驶汽车语音指令交互等应用场景。本次沙龙将重点介绍如何使用NeMo训练自定义语音AI模型,同时上机操作体验在边缘计算设备Jetson NX中实现语音AI模型的推理。

近十年来,数据库技术领域风起云涌,分布式数据库、云原生数据库、图数据库、时序数据库、实时数仓等等,百花齐花,精彩纷呈!在各种技术的应用场景下,问题不断涌现,想要真正解决问题,赶上时代的步伐,就让我们移步DTCC 2022第13届中国数据库技术大会。

自动语音识别是计算机科学和计算语言学的一个跨学科子领域,其开发的方法和技术使计算机可以将口语识别成文本,文本转化成语音 , 它整合了计算机科学,语言学和计算机工程领域的知识和研究。 NVIDIA NeMo是一个用于构建对话式人工智能应用的自动语音识别工具库。它采用语音文本数据为输入,并使用人工智能和自然语言处理模型理解语义,从而实现语音与文字间内容的相互转换。Nemo toolkit可用于构建人机语音文字交互的对话式解决方案,用于搭建智能语音助手,聊天机器人,智能语音翻译 ,声控智能家居及无人驾驶汽车语音指令交互等应用场景。

