声浪
LauraTSE:基于自回归Decoder-only语言模型的目标说话人提取
目标说话人提取(Target Speaker Extraction, TSE)旨在利用参考注册语音等辅助信息,从混合音频中提取目标说话人的语音。目前,大多数TSE方法基于判别式模型(Discriminative Model),通过直接学习混…
13 0 0
语音领域ISCA Fellow 2025公布:上海交大俞凯、台大李宏毅、Nancy Chen三位华人入选
来源丨机器之心 近日,ISCA Fellow 2025 入选结果揭晓! ISCA Fellow 是由国际语音通讯协会(International Speech Communication Association,ISCA)设立的荣誉称号,旨…
11 0 0
物奇科技 | 招聘音频算法开发工程师(深圳)
物奇成立于2016年,在重庆、上海、长沙、香港、深圳等地设有研发中心和客户支持中心,是国内领先的短距通信芯片设计公司,依托领先的通信连接技术,为万物互联的世界提供一流的SoC芯片和软件解决方案。公司在高性能WiFi、蓝牙音频以及PLC宽带电…
17 0 0
陌陌科技 | 急招Omni语音对话大模型算法研发工程师/实习生、大模型语音合成算法工程师/实习生(北京)
陌陌科技,中国领先的社交网络和移动互联网公司,成立于2011年。最初以陌陌聊天应用闻名,用户可以通过地理位置找到附近的人并进行即时通讯。随着发展,陌陌逐渐扩展了其业务,包括直播、短视频和社交电商等。 陌陌的核心业务围绕社交互动,提供丰富的用…
16 0 0
普强信息 | 招聘高级语音算法工程师(北京)
普强于2009年在美国硅谷成立全球研发中心,主要从事智能语音和语言技术的研究,2010年设立中国运营公司,是金融科技创新和智能汽车AI服务提供商,在硅谷和中关村、上海,深圳均建设有技术研发中心,在南京拥有声学实验室,专注于金融大数据、AI芯…
14 0 0
Kimi开源全新音频基础模型,横扫十多项基准测试,总体性能第一
来源丨机器之心 近日,kimi 又发布了新的开源项目 —— 一个全新的通用音频基础模型 Kimi-Audio,支持语音识别、音频理解、音频转文本、语音对话等多种任务,在十多个音频基准测试中实现了最先进的 (SOTA) 性能。 结果显示,Ki…
15 0 0
