语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
逻辑智能|全球首个语音语言模型开源全家桶 LLaSO 来了
语音小管家语音小管家
原创a year ago
逻辑智能|全球首个语音语言模型开源全家桶 LLaSO 来了

语音语言模型(LSLM)领域长期面临碎片化发展困境:架构路径各异、训练数据私有、评估标准缺失,这些问题严重阻碍了技术进步和公平比较。近日,北京深度逻辑智能科技有限公司推出LLaSO——全球首个完全开源的端到端语音语言模型研究框架,旨在为LS…

开源模型
17 0 0
Stable Audio 2.5丨企业级音频生成AI模型,3分钟曲目2秒钟完成
语音小管家语音小管家
转载a year ago
Stable Audio 2.5丨企业级音频生成AI模型,3分钟曲目2秒钟完成

来源丨AI音频时代 人工智能研究实验室Stability AI正式推出企业级音频生成模型Stable Audio 2.5。也是首款针对企业级用例开发的模型。 Stable Audio 2.5在音频细节处理、生成速度、音乐结构完整性以及功能拓…

大模型
19 0 0
【交我学-10】AI for Science:让人工智能赋能科学探索!
语音小管家语音小管家
原创a year ago
【交我学-10】AI for Science:让人工智能赋能科学探索!

大家好,欢迎来到「AudioCC交我学」专栏! 你是否想过,人工智能不仅能写诗画画、聊天写代码,也能成为科学家的“实验搭子”? 2025年4月10日,我们围绕“AI for Science”展开了一次精彩讲座,聚焦人工智能如何帮助科学家解决…

12 0 0
语音/音频处理学术速递[9.15]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[9.15]

语音合成语音识别
13 0 0
Voices 推出首个用于语音 AI 训练的角色音频数据集
语音小管家语音小管家
转载a year ago
Voices 推出首个用于语音 AI 训练的角色音频数据集

来源丨AI音频时代 语音技术及数据服务提供商Voices近日推出了一款面向AI训练的角色语音数据集。该数据集包含超过450种角色类型,由专业配音演员参与录制,覆盖了包括1920年代时髦女性、军事教官和老年巫师在内的多种形象。 据发布信息显示…

音频数据集
12 0 0
MultiTalk:多角色对话生成SOTA模型,语音-视觉对齐精度达98.7%!
语音小管家语音小管家
转载a year ago
MultiTalk:多角色对话生成SOTA模型,语音-视觉对齐精度达98.7%!

来源丨开源星探、AIGC Studio MultiTalk 是一款开源的音频驱动多人对话视频生成框架,由MeiGen-AI联合中山大学、美团和香港科技大学研发。MultiTalk在语音与嘴形同步方面达到了SOTA性能,并支持通过prompt…

开源语音模型
13 0 0
Qwen下一代基础架构突袭!秒解AIME数学竞赛题,提速10倍+性价比提升10倍
语音小管家语音小管家
转载a year ago
Qwen下一代基础架构突袭!秒解AIME数学竞赛题,提速10倍+性价比提升10倍

来源丨量子位 Qwen下一代模型架构,抢先来袭! Qwen3-Next发布,Qwen团队负责人林俊旸说,这就是Qwen3.5的抢先预览版。 基于Qwen3-Next,团队先开源了Qwen3-Next-80B-A3B-Base。 模型参数80…

大模型
13 0 0
语音/音频处理学术速递[9.12]
每日语音速递每日语音速递
原创a year ago
语音/音频处理学术速递[9.12]

语音合成语音识别
12 0 0
语音人的新赛道:脑机接口中的"语音解码"大有可为!
语音小管家语音小管家
转载a year ago
语音人的新赛道:脑机接口中的"语音解码"大有可为!

语音小伙伴们看过来,今天给大家介绍个新赛道! 你是否想过,大脑处理语音信号的过程与我们熟悉的语音识别系统有着惊人的相似性? 从时序信号处理到特征提取,从编码解码到多模态融合,脑机接口与语音技术在底层逻辑上竟然如此相通! 今天让我们一起探索这…

语音解码
13 0 0
ElevenLabs 升级AI 文生音效模型,具有更长的剪辑和更好的音频质量
语音小管家语音小管家
转载a year ago
ElevenLabs 升级AI 文生音效模型,具有更长的剪辑和更好的音频质量

来源丨AI音频时代 AI语音技术公司ElevenLabs正式宣布将其AI文生音效模型升级至版本2。此次更新在音效生成的时长、质量与可控性三大维度实现跨越式提升,标志着AI音频创作正式迈入“专业可用”阶段。 特点说明 1、即时生成 几秒钟内开…

语音模型
13 0 0
‹1…7879808182…479›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)7TIOBE 场景测试:汽车之家 汽车评测8语音信号处理论文优选:Handling Background Noise in Neural Speech Generation9TIOBE 场景测试:经济 金融 货币10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号