来自 Hugging Face 的 Vaibhav Srivastav 最近在推特上发布了一条令人振奋的突破:Speech to Speech语音交互系统,可以极大地提升了人与机器之间的沟通效率与体验。 GitHub 链接:https://…
声浪
GPT-4o级开源语音交互系统发布,交互延迟仅0.5秒
13 0 0
论文分享 | 利用分层韵律建模实现富有表现力的零样本语音合成
基于大模型的语音合成展现出零样本音色克隆的巨大潜力。在大规模数据和大模型的双重作用下,如今的零样本语音合成可以轻松实现未见音色的克隆。然而当前的工作侧重于音色的泛化上,忽略了韵律建模,这使得合成语音的自然度和表现力有限。 近期,西工大音频语…
7 0 0
作业帮 | 招聘语音合成算法leader、语音合成算法工程师、语音识别算法工程师(北京/上海)
作业帮 作业帮成立于 2015 年,作为“数字教育的开拓者”,以“科技为人、成就非凡”为使命,致力于用科技手段助力教育普惠。作业帮始终坚持“教育+科技”双引擎战略,在学习工具产品、智能硬件、智能图书等业务领域深入布局。 作业帮是“国家高新技…
22 0 0
