语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
语音/音频处理学术速递[3.23]
每日语音速递每日语音速递
原创7 months ago
语音/音频处理学术速递[3.23]

语音识别语音合成
27 0 0
ICASSP 2026|迈向构建低资源语种的多任务语音理解模型
语音小管家语音小管家
转载7 months ago
ICASSP 2026|迈向构建低资源语种的多任务语音理解模型

基于语音编码器、适配器和大语言模型(LLM)构建的语音大语言模型(SLLM),在英语和中文等高资源语言中展现了卓越的多任务理解性能。然而,在泰语等低资源语言中,其有效性显著降低。这种局限性主要源于三个因素: 现有的常用语音编码器(如 Whi…

ICASSP 2026
23 0 0
语音/音频处理学术速递[3.20]
每日语音速递每日语音速递
原创7 months ago
语音/音频处理学术速递[3.20]

语音合成语音识别
26 0 0
Soul App发布开源模型SoulX-LiveAct:高鲁棒实时交互数字人,双卡低成本流式生成
语音小管家语音小管家
转载7 months ago
Soul App发布开源模型SoulX-LiveAct:高鲁棒实时交互数字人,双卡低成本流式生成

近日,Soul App AI团队(Soul AI Lab)发布开源模型SoulX-LiveAct。作为新的实时数字人生成方案,SoulX-LiveAct通过 Neighbor Forcing(同扩散步对齐的自回归条件传播)与 ConvKV…

语音合成
18 0 0
语音/音频处理学术速递[3.19]
每日语音速递每日语音速递
原创7 months ago
语音/音频处理学术速递[3.19]

语音识别声纹识别语音合成
28 0 1
Xiaomi MiMo-V2-Pro & Omni & TTS 全球发布
语音小管家语音小管家
转载7 months ago
Xiaomi MiMo-V2-Pro & Omni & TTS 全球发布

语音合成
25 0 0
别再喂给模型“分离人声”了,ANYACCOMP让AI学会只看旋律配伴奏 | ICASSP 2026
语音小管家语音小管家
转载7 months ago
别再喂给模型“分离人声”了,ANYACCOMP让AI学会只看旋律配伴奏 | ICASSP 2026

Singing Accompaniment Generation(SAG,人声伴奏生成)想做的事很直观:给你一段干净的人声/旋律,模型生成一段和声、节奏匹配的伴奏。 但现实里,很多SAG系统都踩在同一个坑上:它们训练时用的“人声输入”,往往…

ICASSP 2026分离人声
13 0 0
语音/音频处理学术速递[3.18]
每日语音速递每日语音速递
原创7 months ago
语音/音频处理学术速递[3.18]

语音合成语音识别
18 0 0
开源流式语义状态预测模块:SoulX-Duplug 让半双工系统秒变全双工
语音小管家语音小管家
原创7 months ago
开源流式语义状态预测模块:SoulX-Duplug 让半双工系统秒变全双工

近日,Soul App AI 团队(Soul AI Lab)联合上海交通大学 X-LANCE Lab和西北工业大学 ASLP@NPU 团队,正式开源 SoulX-Duplug —— 一款面向 全双工语音对话系统(Full-Duplex Sp…

语音合成
29 0 0
ICASSP 2026|首届多语种对话语音大语言模型挑战赛:数据集、任务、基线系统和方法总结
语音小管家语音小管家
转载7 months ago
ICASSP 2026|首届多语种对话语音大语言模型挑战赛:数据集、任务、基线系统和方法总结

构建稳健的对话语音大语言模型(Speech LLM)在很大程度上依赖于真实的多语种对话语音数据,然而当前此类数据的稀缺对该领域的发展构成了重大挑战。Interspeech2025多语种对话语音语言模型(MLC-SLM)挑战赛旨在通过发布真实…

语言模型挑战赛ICASSP 2026
19 0 0
‹1…3940414243…479›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)7TIOBE 场景测试:汽车之家 汽车评测8语音信号处理论文优选:Handling Background Noise in Neural Speech Generation9TIOBE 场景测试:经济 金融 货币10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号