此前,硅基流动SiliconCloud上线了语音识别模型SenseVoice-Small(可免费使用),让开发者可以通过API(兼容OpenAI的API协议)快速接入到语音转文字类应用场景。 在获得Fish Audio商业授权后,Silic…
声浪
启英泰伦 成都启英泰伦科技有限公司(以下简称“启英泰伦”)于2015年11月在成都高新区注册成立,是集语音芯片、语音算法、应用方案、开发平台于一体的行业领导型语音解决方案供应商。公司致力于为用户提供更自然、更简单、更智能的人机交互体验,让“…
面壁智能 面壁智能是一家人工智能大模型技术创新与应用落地企业,愿景为“智周万物”,致力于创造安全、普惠的通用人工智能,让AI技术惠及千万家企业。 我们将努力构建智能时代大模型基础设施,加速大模型在人工智能典型场景与领域应用与落地,成为通用智…
云译科技 云译科技专注于人工智能自然语言处理技术研发和应用,包括语音识别与合成、机器翻译、OCR、舆情监测等,自主研发了支持80多种语言、覆盖超20个垂直细分领域的神经网络机器翻译引擎,并以此为核心,倾力打造智能翻译产品与服务体系。随着人工…
深圳市冠旭电子股份有限公司于1997年成立于中国深圳,总部位于深圳龙岗坪地国际低碳城中心区。 公司主要从事专业音频、智能耳机及智能音箱等智能终端产品的研发、制造及品牌营销。凭借全方位、多领域的核心技术体系及精益化生产管理能力等综合竞争优势,…
近年来,视觉语言模型(VLM)取得了显著进展,训练数据的规模扩展以及数据质量的提升是提升模型性能的关键因素。目前主要的获取数据方式为通过人工对数据进行收集和标注以及利用模型对指令进行合成,业内也有许多工作专注于此。然而,现有的开源数据和指令…
近日,香港中文大学(深圳)联手趣丸科技推出了新一代大规模声音克隆TTS模型——MaskGCT。该模型在包含10万小时多语言数据的Emilia数据集上进行训练,展现出超自然的语音克隆、风格迁移以及跨语种生成能力,同时保持了较强的稳定性。Mas…
大象声科 大象声科(深圳)科技有限公司,简称Elevoc,于2017年在深圳成立,是全球领先的机器听觉人工智能公司之一,致力于提供尖端的智能语音增强和语音交互解决方案,打造更自然的人机交互体验。大象声科云集了一批来自世界顶尖机器听觉科学家和…
