语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
SpeechJudge:让机器真正理解“人类觉得什么是自然”
语音小管家语音小管家
转载8 months ago
SpeechJudge:让机器真正理解“人类觉得什么是自然”

语音合成(TTS)领域长期存在一个矛盾:机器判断的“自然”与人类主观感受脱节。 这样的场景常常出现:你让AI生成一段语音,客观指标显示“完美”(如WER=0、FAD极低),但听起来却像机器人在背书。 如何让机器get到人类觉得“自然”的点?…

语音合成
28 0 0
百变人声·身临其境:Ming-flash-omni-2.0 语音生成
语音小管家语音小管家
转载8 months ago
百变人声·身临其境:Ming-flash-omni-2.0 语音生成

百灵多模态团队节前前发布了 Ming-flash-omni-2.0,基于其语音模块,我们新发布了 Ming-omni-tts,通过模型 scale up 实现了更强的效果。 不管你是短视频博主配旁白,独立播客创作者想把单人对话变成双人播客,…

语音合成
21 0 0
语音/音频处理学术速递[2.20]
每日语音速递每日语音速递
原创8 months ago
语音/音频处理学术速递[2.20]

语音合成语音识别
17 0 0
语音/音频处理学术速递[2.19]
每日语音速递每日语音速递
原创8 months ago
语音/音频处理学术速递[2.19]

语音合成语音识别
13 0 0
语音/音频处理学术速递[2.18]
每日语音速递每日语音速递
原创8 months ago
语音/音频处理学术速递[2.18]

语音合成
15 0 0
语音/音频处理学术速递[2.17]
每日语音速递每日语音速递
原创8 months ago
语音/音频处理学术速递[2.17]

语音合成语音识别
12 0 0
语音/音频处理学术速递[2.16]
每日语音速递每日语音速递
原创8 months ago
语音/音频处理学术速递[2.16]

语音识别语音合成
13 0 0
定义下一代音频基础模型统一接口:300 万小时海量音频预训练的 MOSS-Audio-Tokenizer 正式开源
语音小管家语音小管家
原创8 months ago
定义下一代音频基础模型统一接口:300 万小时海量音频预训练的 MOSS-Audio-Tokenizer 正式开源

在大语言模型(LLM)的演进中,文本分词器(Tokenizer)作为离散接口,为模型的压缩、理解、生成与上下文学习奠定了基石。然而,在音频领域,如何构建一个简单、同构且具备强大扩展潜力(Scalable)的离散接口,依然是通往“原生音频大模…

语音合成
18 0 0
壁仞科技壁砺™ 166M极速支持MOSS-TTS Family
语音小管家语音小管家
转载8 months ago
壁仞科技壁砺™ 166M极速支持MOSS-TTS Family

2月10日,由上海创智学院孵化的模思智能及OpenMOSS团队正式发布并开源了MOSS-TTS Family。模型发布后,壁仞科技(06082.HK)旗舰产品壁砺™ 166M率先完成其中语音生成基座MOSS-TTS模型的高性能推理部署。作为…

语音合成
21 0 0
Zero-Shot 歌声合成来了:支持中英粤三语的 SoulX-Singer 开源
语音小管家语音小管家
转载8 months ago
Zero-Shot 歌声合成来了:支持中英粤三语的 SoulX-Singer 开源

过去一年,生成式人工智能在音乐行业的应用正不断创造新体验,但歌唱语音合成领域(SVS,Singing Voice Synthesis)整体进展相对缓慢。 为拓展这一领域,近日,Soul App AI 团队(Soul AI Lab)与吉利汽车…

语音合成
19 0 0
‹1…2021222324…111›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6TIOBE 场景测试:经济 金融 货币7语音信号处理论文优选:Handling Background Noise in Neural Speech Generation8详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)9TIOBE 场景测试:汽车之家 汽车评测10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号