语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
语音/音频处理学术速递[7.18]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[7.18]

语音合成语音识别
23 0 0
全球首创!B站推出影视级TTS语音模型,支持零样本语音+情绪双克隆,精准时长控制!
语音小管家语音小管家
转载a year ago
全球首创!B站推出影视级TTS语音模型,支持零样本语音+情绪双克隆,精准时长控制!

近年来,文本转语音(TTS)技术在影视配音、虚拟助手等领域需求激增,而高自然度和控制能力成为关键。而能将 TTS 技术做到“影视级”水准的,即使在全球范围内也是屈指可数。 但近日,B站语音团队推出了全新一代语音合成模型:IndexTTS2,…

语音合成
21 0 0
语音/音频处理学术速递[7.17]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[7.17]

语音合成语音识别
16 0 0
语音/音频处理学术速递[7.16]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[7.16]

语音合成语音识别
19 0 0
ACL 2025丨TCSinger2:高度可定制化的多语言零样本歌声合成
语音小管家语音小管家
原创a year ago
ACL 2025丨TCSinger2:高度可定制化的多语言零样本歌声合成

零样本歌声合成(SVS)旨在基于音频或文本提示,生成具有未见过的多级别风格的高质量歌声。该领域在专业音乐创作和短视频配音方面具有广泛的潜在应用。尽管传统的歌声合成任务已经取得了显著进展,但人们对更具定制化的体验需求日益增长。这不仅包括通过音…

语音合成歌声合成
16 0 0
语音/音频处理学术速递[7.15]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[7.15]

语音合成语音识别
20 0 0
语音/音频处理学术速递[7.14]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[7.14]

语音合成语音识别
18 0 0
阿里通义开源首个CoT音频模型,比MMAudio更强视频配音!
语音小管家语音小管家
转载a year ago
阿里通义开源首个CoT音频模型,比MMAudio更强视频配音!

近日,阿里通义实验室开源了旗下首个音频生成模型ThinkSound,该模型首次将CoT(Chain-of-Thought,思维链)应用到音频生成领域,让AI可以像专业音效师一样逐步思考,捕捉视觉细节,生成与画面同步的高保真音频。 目前,Th…

语音合成
16 0 0
语音/音频处理学术速递[7.11]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[7.11]

语音合成语音识别
15 0 0
中文语音领域超强 “活人感” 模型来了,Soul App 升级自研端到端全双工语音通话大模型
语音小管家语音小管家
原创a year ago
中文语音领域超强 “活人感” 模型来了,Soul App 升级自研端到端全双工语音通话大模型

近日,社交平台Soul App正式升级自研端到端全双工语音通话大模型,发布SoulX-DuoVoice。新模型摒弃了传统语音交互中依赖的 VAD(话音激活检测)机制与延迟控制逻辑,打破行业中普遍存在的“轮次对话”模式,赋予 AI 自主决策对…

语音合成语音识别
27 0 0
‹1…4142434445…111›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)7TIOBE 场景测试:经济 金融 货币8语音信号处理论文优选:Handling Background Noise in Neural Speech Generation9TIOBE 场景测试:汽车之家 汽车评测10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号