本文整理了一些近期发表的声学相关论文,供大家了解科研进展。 1.记录和模拟双耳房间听觉中直接混响能量比的神经表示 出版日期:2024-08-30 DOI:10.1101/2024.08.29.610373 作者:Viola G. Matte…
声浪
当前广泛流行的基于 LLaVA 结构的多模态大语言模型(LMM: Large Multimodal Model)在视觉任务上表现出色,然而因为训练中需要对内嵌的语言模型进行微调,常常会显著削弱其在自然语言任务(NLP)上的能力,具体来说,模…
云知声 云知声专注于物联网人工智能服务,拥有完全自主知识产权、世界顶尖的智能语音识别和相关AI技术。公司成立于2012年6月29日,总部位于北京,在上海、深圳均设有分公司。 云知声利用机器学习平台,在语音技术、语言技术、知识计算、大数据分析…
鼎汉技术 北京鼎汉技术集团股份有限公司成立于2002年6月,是一家从事轨道交通多种电气化高端装备及智慧化解决方案研发、生产、销售和维护的高新技术企业。2009年,鼎汉技术在深圳证券交易所上市,成为中国第一批创业板上市企业。公司现部署营销及服…
标贝科技 标贝(北京)科技有限公司(简称“标贝科技”)是一家专注智能语音交互和AI数据服务的人工智能公司,公司拥有的知识产权超过120余项,个人知识产权达80余项。标贝科技以“语音连接场景、数据服务技术”为理念,打造有温度有情感的声音体验,…
巨人网络 巨人网络(002558.SZ)是巨人集团所属中国A股上市公司,是一家用创新驱动的互联网企业,通过提供有核心价值的产品或服务,让用户享受创新带来的便利。公司坚持聚焦、用户第一、阳光经营的发展理念,致力于打造百年品牌。公司坚持自主研发…
上个月,香港中文大学(深圳)联合中国科学院声学研究所、上海人工智能实验室等机构推出了涵盖6种语言、超过10万小时的多样化语音生成数据集——Emilia,并在 GitHub 平台上开源了数据预处理框架 Emilia-Pipe。 详情请见:6种…
说话人确认旨在根据说话人声音的生物信息来确定话者的身份。该项技术在语音识别、语音合成、特定说话人语音提取等领域有重要的应用价值。当前主流的说话人识别系统是基于神经网络的,通常需要昂贵的存储和计算资源,从而阻碍了它们在移动设备上的部署。 近期…
