语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
语音/音频处理学术速递[1.31]
每日语音速递每日语音速递
转载3 years ago
语音/音频处理学术速递[1.31]

今日论文合集:cs.SD语音8篇,eess.AS音频处理8篇。 本文经arXiv每日学术速递授权转载 cs.SD语音

语音识别语音合成声纹识别
69 0 0
语音/音频处理学术速递[1.30]
每日语音速递每日语音速递
转载3 years ago
语音/音频处理学术速递[1.30]

今日论文合集:cs.SD语音12篇,eess.AS音频处理11篇。 本文经arXiv每日学术速递授权转载 cs.SD语音

语音识别语音合成声纹识别
58 0 0
工程经验分享 Incremental FastPitch
语音小管家语音小管家
转载3 years ago
工程经验分享 Incremental FastPitch

分享 NVIDIA 基于 GPU 的 TTS 解决方案介绍。 1.基于 FastPitch+Hifi-GAN 的 Streaming TTS 效果优化 NVIDIA 在 TTS 领域也做了一些供大家参考的工作,例如提供了高效的流式 TTS…

语音合成
68 0 0
语音/音频处理学术速递[1.29]
每日语音速递每日语音速递
转载3 years ago
语音/音频处理学术速递[1.29]

今日论文合集:cs.SD语音10篇,eess.AS音频处理11篇。 本文经arXiv每日学术速递授权转载 cs.SD语音

语音识别语音合成声纹识别
66 0 0
NPU-ASLP实验室10篇论文被ICASSP2024录用
西工大音频语音与语言处理研究组西工大音频语音与语言处理研究组
转载3 years ago
NPU-ASLP实验室10篇论文被ICASSP2024录用

西工大音频语音与语言处理研究组(ASLP@NPU)在本届会议将携合作伙伴宣读论文10篇,涉及智能语音处理领域的众多研究方向,包括语音识别、语音合成与转换、语音增强等。论文的合作单位包括理想汽车、网易、喜马拉雅、字节跳动、马上金融、出门问问、…

语音合成语音识别语音增强
106 0 0
语音/音频处理学术速递[1.24]
每日语音速递每日语音速递
转载3 years ago
语音/音频处理学术速递[1.24]

今日论文合集:cs.SD语音11篇,eess.AS音频处理11篇。 本文经arXiv每日学术速递授权转载 cs.SD语音

语音合成
62 0 0
Sensors|基于交互注意力音视频融合的人员验证
语音小管家语音小管家
转载3 years ago
Sensors|基于交互注意力音视频融合的人员验证

标题:Audio–Visual Fusion Based on Interactive Attention for Person Verification 作者:景雪斌,何亮,宋志达,王少磊 单位:新疆大学计算机科学与技术学院、清华大学电子…

语音合成
49 0 0
GPT-SoVits: 上线两天获得了1.4k star的开源声音克隆项目,1分钟语音训练TTS模型
语音小管家语音小管家
转载3 years ago
GPT-SoVits: 上线两天获得了1.4k star的开源声音克隆项目,1分钟语音训练TTS模型

近期,RVC变声器创始人 (GitHub昵称:RVC-Boss)开源了一款跨语言音色克隆项目 GPT-SoVITS。项目一上线就引来了互联网大佬和博主的好评推荐,不到两天时间就已经在GitHub上获得了1.4k Star量。 项目地址:ht…

语音合成
100 0 0
NCMMSC 2023论文|基于概率稀疏自注意力的说话人自适应语音合成
语音小管家语音小管家
转载3 years ago
NCMMSC 2023论文|基于概率稀疏自注意力的说话人自适应语音合成

标题:Explore Speaker Adaptation Text-to-Speech Method Based ProbSparse Self-attention 作者:冷媛媛,王宗挥,方志华,张云祥,何亮 单位:新疆大学计算机科学与技…

语音合成
34 0 0
语音/音频处理学术速递[1.22]
每日语音速递每日语音速递
转载3 years ago
语音/音频处理学术速递[1.22]

今日论文合集:cs.SD语音14篇,eess.AS音频处理14篇。 本文经arXiv每日学术速递授权转载 cs.SD语音

语音合成
58 0 0
‹1…9394959697…111›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6TIOBE 场景测试:经济 金融 货币7语音信号处理论文优选:Handling Background Noise in Neural Speech Generation8详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)9TIOBE 场景测试:汽车之家 汽车评测10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号