声浪
来源丨AI音频时代 NVIDIA 在多语种语音 AI 领域迈出重要一步,正式发布了Granary 数据集和两款最新模型Canary-1b-v2与Parakeet-tdt-0.6b-v3,为欧洲语言的自动语音识别与语音翻译设立了全新基准。 在…
全国人机语音通讯会议是国内语音领域广大专家、学者和科研工作者交流最新研究成果,促进该领域研究和开发工作不断进步的重要舞台。该系列会议自1990年开创以来已成功召开了十九届。2025年第二十届全国人机语音通讯学术会议(National Con…
大家好,欢迎来到「AudioCC交我学」专栏! 作为学术研究者与实践者的连接点,我们致力于打造一个专注于语音技术的学术交流平台——「AudioCC交我学」专栏。在这里,我们将以简洁、专业的视角,解读听觉认知与计算声学领域的前沿论文,分享技术…
武汉大学、昆山杜克大学、中科院声学所、OfSpectrum与AISHELL联合发布的MIIP-NV数据集,旨在填补中文语音合成领域非语言语音(NV)合成开源数据的空白。这一数据集为情感语音合成领域提供了强有力的支持!🎉🎉 SMIIP-N…
京 东 集 团 京东科技集团是京东集团旗下专注于以技术为产业服务的业务子集团,致力于为企业、金融机构、政府等各类客户提供全价值链的技术性产品与解决方案。依托人工智能、大数据、云计算、物联网等前沿科技能力,京东科技打造出了面向不同行业的产品和…
上一期我们介绍了团队推出的高效零样本语音合成模型 ZipVoice,随着 notebook lm 的大火,对话语音合成(播客生成)也火了一把,本期将为你带来 ZipVoice 在零样本对话语音合成上的扩展 ZipVoice-Dialog[1…
2025 年 8 月 18 日,CCF语音对话与听觉专委会主任、上海交通大学特聘教授、思必驰联合创始人兼首席科学家俞凯在荷兰鹿特丹举办的Interspeech 2025大会上正式被授予ISCA Fellow荣誉,以表彰他在语音识别、口语对话…
