声浪
分享3篇IMU语音理解与生成实验室被中科院一区Top期刊Information Fusion 录用的论文,内容涵盖对话语音合成、视听语音识别生成式纠错、语音鉴伪等。 《Information Fusion》在中科院分区中为计算机科学大类一区…
Seed-VC 是由开发者 Plachtaa 在 GitHub 上开源的项目,其灵感来源于字节跳动的 SEED-TTS 架构,是一款超强大的开源语音转换和歌曲转换工具。 项目地址:https://github.com/Plachtaa/se…
慧言科技(天津)有限公司是一家业内领先的言语交互高新技术企业。公司基于自主可控“海河·谛听”言语交互意图理解大模型,研发语音识别、语音生成、语义理解、文本生成、知识问答、机器翻译、声纹识别等全链路言语交互技术,支持中英日韩法西俄德维藏泰越等…
近期上海交通大学听觉认知与计算声学实验室,联合美国卡内基梅隆大学CMU和日本电报电话公司NTT,合作的论文“Module-Based End-to-End Distant Speech Processing: A Case Study of…
北美计算语言学协会年会(The North American Chapter of the Association for Computational Linguistics,NAACL)成立于1998年,每年举办一届,是自然语言处理和计算…
在 NLP 领域,大模型(LLMs)凭借其强大的理解和推理能力,正在重塑行业格局。另一方面,多模态大模型,尤其是以语音交互为核心的模型也开始崛起,技术发展迅猛,前景广阔。以 GPT-4o 为例,语音与大模型的端到端结合展示出了高实时性与强表…
云译科技专注于人工智能自然语言处理技术研发和应用,包括语音识别与合成、机器翻译、OCR、舆情监测等,自主研发了支持80多种语言、覆盖超20个垂直细分领域的神经网络机器翻译引擎,并以此为核心,倾力打造智能翻译产品与服务体系。随着人工智能技术的…
深圳路知音科技有限公司,是一家专注于CarPlay/Android Auto/MirrorLink手机与车机互联解决方案出海的公司,从2009年香港公司创立到2014年深圳公司成立,我们一直致力于车载影音导航的资源整合,研发及销售,为全球区…
