声浪
开发者可以使用平台所提供的脚本及各数据标准剪切集来开发及评估语音情绪模型;得到准确率后,可以提出要求将所得到的准确率纳入排行榜中;穿透此平台,开发者可以与平台提供的结果做比较,也可以利用平台做出有趣的分析。 Conference: 2024…
Neural audio codecs (NACs) 已成为音频压缩和语音语言模型(SLM)表示的关键技术,近年来得到了极大的发展。 微软提出TS3-Codec,为codec模型设计提供了崭新的思路。它是首个完全基于 Transformer…
来源丨 Z Potentials 语音人工智能初创公司 ElevenLabs 近期推出了一项功能,允许用户上传不同类型的内容,创建一个多语音播客,类似于Google 的 NotebookLM。 该功能称为 GenFM,可以在公司的 Elev…
为促进最新研究成果的传播与交流,CCF语音对话与听觉专委在专委会微信公众号启动论文导读栏目,定期分享最新语音、对话与听觉相关研究方向论文。本期分享一篇发表在IEEE/ACM Transactions on Audio, Speech, an…
汉王科技 汉王科技股份有限公司成立于1998年,作为国内人工智能产业的先行者,汉王科技潜心深耕二十余载,始终致力于多领域智能交互技术的研究与应用。在手写识别、光学字符识别(OCR)、人脸识别、笔迹输入等领域拥有多项具有自主知识产权的核心技术…
GVoice 隶属于为腾讯游戏(IEG), 为IEG各大游戏,包括王者荣耀、和平精英和PUBGM在内,提供语音相关的技术能力。技术范围:实时语音、语音消息、语音转文字、范围语音、 3D语音、文明语音、语音同传、未成年人识别等,多种适用于游戏…
云上曲率 云上曲率LiveData(北京云上曲率科技有限公司),泛娱乐行业全球领先的实时通信、AI+大数据服务提供商。自主研发基于微服务的高性能分布式框架和深度学习平台。服务覆盖全球200多个国家和地区。核心成员来自谷歌/腾讯/Facebo…
小水智能 北京烽火万家科技有限公司 (品牌: 小水智能) 成立于2013年,以通信业务为基础,发展出5G消息、通信物联网、AI数字人三大业务群,并围绕人工智能与5G技术打造PaaS智能交互平台,实现文本语音、视频、脑机接口、AI数字人等多模…
