语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
音效制作变天!这款AI人工智能的声音搜索工具值得关注 Orion
语音小管家语音小管家
转载a year ago
音效制作变天!这款AI人工智能的声音搜索工具值得关注 Orion

无论你怎样去看去对待,当下的我们都身处在一场革命中,AI正在一步步改变几十年上百年的传统,也包括声音制作!而今年将是音效制作与设计的颠覆性一年,首先就从音频搜索开始。 有经验的声音制作人都知道,对于音效使用、制作与设计来说,往往耗费精力和时…

TTS
18 0 0
VoxCPM:最新开源 TTS 模型!0.5B 的声音克隆神器。
语音小管家语音小管家
转载a year ago
VoxCPM:最新开源 TTS 模型!0.5B 的声音克隆神器。

来源丨THUHCSI人机语音交互实验室 本文介绍由清华大学人机语音交互实验室(THUHCSI)与面壁智能联合研发的VoxCPM,一款 0.5B 参数尺寸的中英双语语音生成基座模型 。 VoxCPM在合成语音的自然度、音色相似度及韵律表现力方…

语音合成
20 0 0
DeepSeek登上Nature封面!梁文锋带队回应质疑,R1训练真29.4万美金
语音小管家语音小管家
转载a year ago
DeepSeek登上Nature封面!梁文锋带队回应质疑,R1训练真29.4万美金

来源丨新智元 DeepSeek荣登Nature封面,实至名归!今年1月,梁文锋带队R1新作,开创了AI推理新范式——纯粹RL就能激发LLM无限推理能力。Nature还特发一篇评论文章,对其大加赞赏。 刚刚,DeepSeek-R1登上了Nat…

热点
18 0 0
语音/音频处理学术速递[9.18]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[9.18]

语音合成语音识别
21 0 0
重磅开源!通义首个深度研究Agent模型DeepResearch来了
语音小管家语音小管家
转载a year ago
重磅开源!通义首个深度研究Agent模型DeepResearch来了

来源丨阿里云 近日,通义首个深度研究Agent模型DeepResearch正式开源。该模型参数仅30B(激活3B),在多个权威评测集上取得SOTA成绩,超越众多顶级Agent模型。 目前,通义DeepResearch的模型、框架和方案均已全…

开源模型
19 0 0
语音/音频处理学术速递[9.17]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[9.17]

语音合成语音识别
16 0 0
FireRedTTS-2:小红书开源语音模型,3分钟生成4人对话!
语音小管家语音小管家
转载a year ago
FireRedTTS-2:小红书开源语音模型,3分钟生成4人对话!

最近小红书团队放出了一个具有突破性意义的 TTS 开源项目 FireRedTTS-2 。它是一款专门面向多人对话场景的 TTS(Text-to-Speech)模型。 FireRedTTS-2是一种长形式流式TTS系统,专注于多人对话生成,采…

语音合成
22 0 0
阿里发布 FunAudio-ASR 端到端语音识别大模型
语音小管家语音小管家
转载a year ago
阿里发布 FunAudio-ASR 端到端语音识别大模型

阿里巴巴通义实验室推出了FunAudio-ASR端到端语音识别大模型。这款模型通过创新的Context模块,针对性优化了“幻觉”、“串语种”等关键问题,在高噪声的场景下,幻觉率从78.5%下降至10.7%,下降幅度接近70%。 FunAud…

开源模型
23 0 0
【通知】第二十二届全国人机语音通讯学术会议承办方征集通知
语音小管家语音小管家
转载a year ago
【通知】第二十二届全国人机语音通讯学术会议承办方征集通知

全国人机语音通讯学术会议(National Conference on Man-Machine Speech Communication,简称NCMMSC),是我国语音科学和技术领域广大专家、学者及科研工作者开展学术研讨与产学交流的重要平台…

人机语音通讯学术会议
11 0 0
语音/音频处理学术速递[9.16]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[9.16]

语音识别语音合成
14 0 0
‹1…7778798081…479›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)7TIOBE 场景测试:汽车之家 汽车评测8语音信号处理论文优选:Handling Background Noise in Neural Speech Generation9TIOBE 场景测试:经济 金融 货币10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号