声浪
近期,OpenAI提出了Orchestrating Agents,并同时开源了Swarm,一个轻量级的多智能体编排框架,目前仅是示范框架,并没有计划用于生产。 使用语言模型时,我们通常需要好的prompt并结合较强工具调用能力,Orches…
近期安徽大学生物信息感知与人机交互团队联合清华大学提出了一种双重注意力精炼网络的听觉注意力检测方法,相关成果被NeurIPS 2024接收,论文第一作者为安徽大学计算机科学与技术学院2021级本科生严盛。 论文题目:DARNet: Dual…
今日论文合集:cs.SD语音8篇,eess.AS音频处理10篇。 本文经arXiv每日学术速递授权转载 cs.SD语音 【1】 Leveraging LLM Embeddings for Cross Dataset Label Alignm…
异常声音检测(Anomalous Sound Detection,ASD)在工业环境中通过应用人工智能技术获得了显著关注。尽管具有潜力,ASD系统在实际应用中因数据收集困难和环境复杂而面临泛化问题。近期,清华大学语音与音频技术实验室(SAT…
启英泰伦 成都启英泰伦科技有限公司(以下简称“启英泰伦”)于2015年11月在成都高新区注册成立,是集语音芯片、语音算法、应用方案、开发平台于一体的行业领导型语音解决方案供应商。公司致力于为用户提供更自然、更简单、更智能的人机交互体验,让“…
易车 易车公司成立于2000年,于2010年在美国纽交所挂牌上市,并于2020年11月完成私有化,成为腾讯大家庭一员。作为中国头部的汽车互联网企业,易车公司为中国汽车用户提供专业、丰富的互联网资讯和导购服务,并为汽车厂商和汽车经销商提供卓有…
F5-TTS是一款基于流匹配的全非自回归文本到语音转换系统,由上海交通大学、剑桥大学和吉利汽车研究院的研究团队联合开发。该系统无需复杂设计,如持续时间模型、文本编码器和音素对齐,能够实现快速训练,并达到RTF(实时因素)0.15的推理速度,…
Akulaku Akulaku是东南亚市场交易量较大,用户活跃度较高,团队成熟和发展速度较快的互联网金融平台。目前已覆盖印度尼西亚、菲律宾、越南等市场,致力于提供更本地化的产品服务。 Akulaku目前的主要产品是一款提供虚拟信用卡的分期购…
