语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
语音/音频处理学术速递[7.25]
每日语音速递每日语音速递
原创4 years ago
语音/音频处理学术速递[7.25]

今天跟大家分享一篇语音相关的论文合集:cs.SD语音9篇,eess.AS音频处理9篇。 cs.SD语音 【1】 Learning Unsupervised Hierarchies of Audio Concepts 标题:学习音频概念的无监…

语音识别
170 0 0
语音/音频处理学术速递[7.22]
每日语音速递每日语音速递
原创4 years ago
语音/音频处理学术速递[7.22]

今天跟大家分享一篇语音相关的论文合集:cs.SD语音7篇,eess.AS音频处理8篇。 cs.SD语音 【1】 STOP: A dataset for Spoken Task Oriented Semantic Parsing 标题:STO…

语音识别
120 0 0
Tiny-Transducer(2) 设备端轻量级自定义唤醒模型 — CaTT-KWS
语音小管家语音小管家
转载4 years ago
Tiny-Transducer(2) 设备端轻量级自定义唤醒模型 — CaTT-KWS

来源丨https://zhuanlan.zhihu.com/p/534840415 作者丨孙思宁 本文主要是基于我们即将发表于Interspeech2022的文章 “CaTT-KWS: A Multi-stage Customized Ke…

唤醒任务
211 1 0
Tiny-Transducer(1) 设备端轻量级ASR模型
语音小管家语音小管家
转载4 years ago
Tiny-Transducer(1) 设备端轻量级ASR模型

来源丨https://zhuanlan.zhihu.com/p/531934889 作者丨孙思宁 本文主要基于我们之前发表的论文“Tiny Transducer: A Highly-Efficient Speech Recognition…

语音识别语音合成
420 0 0
语音/音频处理学术速递[7.21]
每日语音速递每日语音速递
原创4 years ago
语音/音频处理学术速递[7.21]

今天跟大家分享一篇语音相关的论文合集:cs.SD语音9篇,eess.AS音频处理9篇。 cs.SD语音 【1】 Fine-grained Early Frequency Attention for Deep Speaker Recognit…

语音合成
260 0 0
论文推介:CaTT-KWS—基于级联Transducer-Transformer的多阶段自定义关键词识别框架
西工大音频语音与语言处理研究组西工大音频语音与语言处理研究组
原创4 years ago
论文推介:CaTT-KWS—基于级联Transducer-Transformer的多阶段自定义关键词识别框架

文章来源于音频语音与语言处理研究组,作者杨展恒 关键词识别(Keyword Spotting,KWS)旨在从连续的音频流中检测特定的关键词,被广泛应用于各种端侧设备中作为语音交互的入口组件,例如智能家居的设备唤醒(WuW)和设备操控(Com…

关键词识别
200 0 0
语音/音频处理学术速递[7.20]
每日语音速递每日语音速递
原创4 years ago
语音/音频处理学术速递[7.20]

今天跟大家分享一篇语音相关的论文合集:cs.SD语音5篇,eess.AS音频处理6篇。 cs.SD语音 【1】 Machine-learning applied to classify flow-induced sound paramete…

语音识别
123 0 0
语音/音频处理学术速递[7.19]
每日语音速递每日语音速递
原创4 years ago
语音/音频处理学术速递[7.19]

今天跟大家分享一篇语音相关的论文合集:cs.SD语音11篇,eess.AS音频处理11篇。 cs.SD语音 【1】 Style Transfer of Audio Effects with Differentiable Signal Pro…

212 0 0
开源工具 | ASV-Subtools重大更新:支持在线训练等功能
语音小管家语音小管家
转载4 years ago
开源工具 | ASV-Subtools重大更新:支持在线训练等功能

天聪智能 ASV-Subtools是厦门大学智能语音实验室(XMUSPEECH)于2020年6月推出的一套高效、易于扩展的声纹识别开源工具,该工具是基于Kaldi与Pytorch开发的,充分结合了Kaldi 在语音信号和后端处理的高效性以及…

声纹识别
280 0 0
论文分享|腾讯音乐天琴实验室两篇论文入选国际会议INTERSPEECH
语音小管家语音小管家
转载4 years ago
论文分享|腾讯音乐天琴实验室两篇论文入选国际会议INTERSPEECH

一年一度的全球语音大会INTERSPEECH 2022论文评选结果已经揭晓,我们的论文I《KaraTuner: Towards end to end natural pitch correction for singing voice in…

语音识别信号处理
240 0 0
‹1…255256257258259…314›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6语音信号处理论文优选:Handling Background Noise in Neural Speech Generation7TIOBE 场景测试:汽车之家 汽车评测8详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)9TIOBE 场景测试:经济 金融 货币10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号