语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
语音/音频处理学术速递[3.13]
每日语音速递每日语音速递
原创7 months ago
语音/音频处理学术速递[3.13]

语音识别语音合成
19 0 0
Fish Audio 开源 S2 文本转语音模型,支持1.5万种情感控制,单卡100ms极速推理!
语音小管家语音小管家
转载7 months ago
Fish Audio 开源 S2 文本转语音模型,支持1.5万种情感控制,单卡100ms极速推理!

来源丨RET开发者社区 传统的AI语音合成往往因缺乏情感表达而显得机械生硬。Fish Audio最新开源的文本转语音模型Fish Audio S2,致力于解决这一痛点。该模型能够生成包含清嗓、叹息、笑场等细微人类声学特征的语音。 模型权重、…

语音合成
27 0 0
语音/音频处理学术速递[3.12]
每日语音速递每日语音速递
原创7 months ago
语音/音频处理学术速递[3.12]

语音合成语音识别
16 0 0
Emilia-NV:让ASR/TTS有“人味儿”的秘诀 | ICASSP2026
语音小管家语音小管家
转载7 months ago
Emilia-NV:让ASR/TTS有“人味儿”的秘诀 | ICASSP2026

我们平时说话,信息不只在“字面内容”里,还藏在各种副语言声音里:笑、喘气、叹气、咳嗽,以及“嗯/啊/哦”这类带态度的语气词。它们在真实对话里承担了大量功能: 表达情绪与态度:开心的笑、无奈的叹气、不耐烦的“哼” 组织对话节奏:思考时的“呃/…

语音合成语音识别
36 0 0
语音/音频处理学术速递[3.11]
每日语音速递每日语音速递
原创7 months ago
语音/音频处理学术速递[3.11]

语音识别语音合成
18 0 0
语音/音频处理学术速递[3.10]
每日语音速递每日语音速递
原创7 months ago
语音/音频处理学术速递[3.10]

语音合成语音识别
18 0 0
语音/音频处理学术速递[3.9]
每日语音速递每日语音速递
原创7 months ago
语音/音频处理学术速递[3.9]

语音合成语音识别
18 0 0
【语音技术和应用趋势分享系列(8)】龙虾时代的语音智能体
语音小管家语音小管家
转载7 months ago
【语音技术和应用趋势分享系列(8)】龙虾时代的语音智能体

以下文章来源于AI语音AI思考 本系列共十篇文章,旨在深入剖析之前提到的十大趋势。 关于未来语音技术和应用趋势的10点看法 文章将穿插科普知识、技术综述、发展路线,以及我个人和其他行业专家的思考。无论读者此前对语音技术与应用了解多少,都希望…

语音合成
20 0 0
语音/音频处理学术速递[3.6]
每日语音速递每日语音速递
原创7 months ago
语音/音频处理学术速递[3.6]

语音识别语音合成
19 0 0
创作一首新歌只需2秒!阶跃星辰开源音乐生成模型 ACE-Step 1.5
语音小管家语音小管家
转载7 months ago
创作一首新歌只需2秒!阶跃星辰开源音乐生成模型 ACE-Step 1.5

由阶跃星辰和ACE Studio联合发布的开源音乐生成模型ACE-Step 1.5,制作一首商业歌曲仅需 2-10 秒。 ACE-Step 1.5能“一人”包揽从创作端的作词、作曲、编曲,到制作端的制作人、录音师、混音师、母带师,再到前台歌…

语音合成
16 0 0
‹1…1819202122…111›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6TIOBE 场景测试:经济 金融 货币7语音信号处理论文优选:Handling Background Noise in Neural Speech Generation8详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)9TIOBE 场景测试:汽车之家 汽车评测10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号