语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
语音/音频处理学术速递[12.24]
每日语音速递每日语音速递
原创10 months ago
语音/音频处理学术速递[12.24]

语音合成语音识别
24 0 0
Google 开源面向医学的语音识别 MedASR,专用开源模型的春天来了?
语音小管家语音小管家
原创10 months ago
Google 开源面向医学的语音识别 MedASR,专用开源模型的春天来了?

官方 Blog: https://developers.google.com/health-ai-developer-foundations/medasr huggingface: https://huggingface.co/google…

语音识别
20 0 0
语音/音频处理学术速递[12.23]
每日语音速递每日语音速递
原创10 months ago
语音/音频处理学术速递[12.23]

语音合成语音识别
18 0 0
智谱GLM-4.7上线并开源,代码能力超越GPT-5
语音小管家语音小管家
转载10 months ago
智谱GLM-4.7上线并开源,代码能力超越GPT-5

GLM-4.7上线并开源。新版本面向Coding场景强化了编码能力、长程任务规划与工具协同,并在多项主流公开基准测试中取得开源模型中的领先表现。 目前,GLM-4.7已通过BigModel.cn提供API,并在z.ai全栈开发模式中上线Sk…

大模型
16 0 0
【技术报告】第二届语音对话与听觉处理前沿进展研讨会技术报告(RASDAP2025) Technical Report
语音小管家语音小管家
原创10 months ago
【技术报告】第二届语音对话与听觉处理前沿进展研讨会技术报告(RASDAP2025) Technical Report

为了更好地推动语音对话与听觉处理领域的深入交流与前沿研究,由中国计算机学会(CCF)语音对话与听觉专委会发起的第二届语音对话与听觉处理前沿进展研讨会(RASDAP2025,Recent Advances on Speech Dialogue…

30 0 0
AI人工智能视频声音生成初创公司 Mirelo 获得 4100 万美元的种子轮融资
语音小管家语音小管家
转载10 months ago
AI人工智能视频声音生成初创公司 Mirelo 获得 4100 万美元的种子轮融资

来源丨AI音频时代 2025年12月16日,德国 音频初创公司 Mirelo AI宣布完成4100万美元种子轮融资。本轮融资由Index Ventures和Andreessen Horowitz领投,Atlantic.vc与TriplePo…

资讯
18 0 0
语音/音频处理学术速递[12.22]
每日语音速递每日语音速递
原创10 months ago
语音/音频处理学术速递[12.22]

语音识别语音合成
32 0 0
NTT新成果:All-in-One ASR统一三模型双模式,手机等轻量设备落地更轻松
语音小管家语音小管家
转载10 months ago
NTT新成果:All-in-One ASR统一三模型双模式,手机等轻量设备落地更轻松

标题:All-in-One ASR: Unifying Encoder-Decoder Models of CTC, Attention, and Transducer in Dual-Mode ASR 地址:https://arxiv.o…

语音识别
30 0 1
卡内基梅隆大学等团队改造SLM,实现高质量歌声合成
语音小管家语音小管家
转载10 months ago
卡内基梅隆大学等团队改造SLM,实现高质量歌声合成

标题:Adapting Speech Language Model to Singing Voice Synthesis 链接:https://arxiv.org/pdf/2512.14657 作者单位:卡内基梅隆大学、中国人民大学、约翰霍…

语音合成
21 0 0
语音/音频处理学术速递[12.19]
每日语音速递每日语音速递
原创10 months ago
语音/音频处理学术速递[12.19]

语音合成语音识别
29 0 0
‹1…5152535455…314›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6TIOBE 场景测试:经济 金融 货币7语音信号处理论文优选:Handling Background Noise in Neural Speech Generation8详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)9TIOBE 场景测试:汽车之家 汽车评测10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号