语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
语音AI企业的绝佳曝光机会 | ISCSLP 2026 赞助商招募中!
语音小管家语音小管家
转载6 months ago
语音AI企业的绝佳曝光机会 | ISCSLP 2026 赞助商招募中!

🎯中文口语语言处理国际会议 International Symposium on Chinese Spoken Langauge Processing (ISCSLP) 会议时间:2026年11月14-17日 会议地点:马来西亚·槟城 往…

资讯
18 0 0
语音/音频处理学术速递[4.8]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.8]

语音合成语音识别
23 0 0
ICME 2026|基于细粒度视听证据解耦的鲁棒多模态情感推理
语音小管家语音小管家
转载6 months ago
ICME 2026|基于细粒度视听证据解耦的鲁棒多模态情感推理

多模态情感分析正经历从静态分类向生成式推理(Generative Reasoning)的深刻范式转变。为了理解复杂的社交互动,系统必须能够综合诸如面部微表情和语音韵律等细粒度信号,以解码潜在的因果逻辑。 近年来,虽然通用多模态大语言模型(如…

情感推理
21 0 0
南京大学等联合发布开源语音大模型VITA-Qinyu,首发支持角色扮演+哼唱
语音小管家语音小管家
转载6 months ago
南京大学等联合发布开源语音大模型VITA-Qinyu,首发支持角色扮演+哼唱

来源丨paperWeekly 近日,南京大学与腾讯音乐发布开源语音大模型 VITA-Qinyu ,这是业内首款兼具自然对话、高表现力角色扮演与歌唱能力的 开源端到端语音语言模型 (SLM)。目前 VITA-QinYu 的训练代码与模型权重全…

语音合成
26 0 0
语音/音频处理学术速递[4.7]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.7]

语音合成语音识别
23 0 0
AAAI 2026|多指标偏好对齐,让生成式降噪更好听
语音小管家语音小管家
转载6 months ago
AAAI 2026|多指标偏好对齐,让生成式降噪更好听

语音修复(Speech Restoration)要解决的事很朴素: 把一段“坏掉的语音”修回“听起来像正常录音”的样子。坏的方式很多,比如: 降噪:背景嘶嘶声、风噪、环境噪 去混响:房间回声太大 去削波/爆音(declipping):录音过…

生成式降噪
27 0 0
告别 “聊不到一块去”!港中大提出TurnGuide:让全双工语音大模型兼具“极致拟人”与“满分语商”!
语音小管家语音小管家
原创6 months ago
告别 “聊不到一块去”!港中大提出TurnGuide:让全双工语音大模型兼具“极致拟人”与“满分语商”!

文章链接:https://arxiv.org/pdf/2508.07375 想象一下,当你和AI 语音助手聊天时,它可以像真人一样自然地倾听、适时地“嗯、啊”附和,甚至在你打断它时迅速反应。这就是全双工语音大模型(FD-SLMs)的魅力所在…

语音大模型
27 0 0
Voxtral TTS,仅4B参数SOTA性能,超低延迟9种语言语音生成转录和24kHz音频输出。
语音小管家语音小管家
转载6 months ago
Voxtral TTS,仅4B参数SOTA性能,超低延迟9种语言语音生成转录和24kHz音频输出。

来源丨AIGC Studio Voxtral TTS是首个在多语言语音生成方面拥有顶尖性能的文本转语音模型。基于大型语音数据集进行训练,专为全球应用而构建。它支持 9 种语言,性能一流:英语、法语、德语、西班牙语、荷兰语、葡萄牙语、意大利语…

语音合成
17 0 0
语音/音频处理学术速递[4.3]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.3]

语音识别语音合成
20 0 0
RTE 开发者社区发布 RealNoise™ TTS:全球首个原生合成动态声场的语音大模型
语音小管家语音小管家
转载6 months ago
RTE 开发者社区发布 RealNoise™ TTS:全球首个原生合成动态声场的语音大模型

来源丨RTE 开发者社区 🔊本文是RTE开发者社区于4月1日愚人节和 AI 一起凭空造了一个能「感知语境并动态合成环境噪声的 TTS 模型」,虽是愚人节彩蛋,但有一定的参考价值。🔊 近日, 由 RTE 开发者社区共创孵化的 Noice…

语音合成
26 0 0
‹1…3031323334…314›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)7TIOBE 场景测试:汽车之家 汽车评测8语音信号处理论文优选:Handling Background Noise in Neural Speech Generation9TIOBE 场景测试:经济 金融 货币10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号