语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
小米发布 MiMo-V2.5-TTS-Series + ASR
语音小管家语音小管家
转载6 months ago
小米发布 MiMo-V2.5-TTS-Series + ASR

今天,小米发布MiMo-V2.5-TTS Series与MiMo-V2.5-ASR—— 一套面向 Agent 时代的全链路语音模型系列,覆盖识别与合成两大核心能力,让语音的输入与输出都可以被语言自由调度。 MiMo-V2.5-TTS Ser…

语音合成语音识别
24 0 0
ACL 2026丨内蒙古大学语音理解与生成实验室5篇录用论文分享
语音小管家语音小管家
转载6 months ago
ACL 2026丨内蒙古大学语音理解与生成实验室5篇录用论文分享

Annual Meeting of the Association for Computational Linguistics(简称 ACL)年会是计算语言学和自然语言处理领域国际排名第一的顶级学术会议,由国际计算语言学协会组织,每年召开一…

语音识别语音合成
25 0 0
语音/音频处理学术速递[4.23]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.23]

语音识别语音合成
16 0 0
语音/音频处理学术速递[4.22]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.22]

语音合成语音识别
19 0 0
语音/音频处理学术速递[4.21]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.21]

语音合成语音识别
17 0 0
语音/音频处理学术速递[4.20]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.20]

语音合成语音识别
28 0 0
语音/音频处理学术速递[4.17]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.17]

语音合成语音识别
24 0 0
阶跃发布 StepAudio 2.5 TTS,零样本复刻+全音色调控
语音小管家语音小管家
转载6 months ago
阶跃发布 StepAudio 2.5 TTS,零样本复刻+全音色调控

今天,阶跃发布新一代语音生成模型StepAudio 2.5 TTS! 围绕全局语境控制、文中语境控制、零样本复刻与全音色控制三项核心能力, StepAudio 2.5 TTS 让语音生成更自然、更灵活也更有表现力。 全局语境控制:支持自定义…

语音合成
29 0 0
语音/音频处理学术速递[4.15]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.15]

语音识别语音合成
26 0 0
YingMusic-Singer-Plus:同一段旋律,歌词随便换:改写、翻译,AI全都能重唱
语音小管家语音小管家
转载6 months ago
YingMusic-Singer-Plus:同一段旋律,歌词随便换:改写、翻译,AI全都能重唱

你有没有想过,一首歌能不能任意改词,旋律保持不变? 想象一下这样的场景:你特别喜欢一首歌的旋律,但歌词想换成自己写的;或者你想把一首中文歌"翻唱"成英文版,旋律保持不变,歌词却是全新的英文内容。以前要做到这件事,要么得先提取MIDI,手动对…

语音合成
13 0 0
‹1…1314151617…111›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6TIOBE 场景测试:经济 金融 货币7语音信号处理论文优选:Handling Background Noise in Neural Speech Generation8详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)9TIOBE 场景测试:汽车之家 汽车评测10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号