语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
逻辑智能|全球首个语音语言模型开源全家桶 LLaSO 来了
语音小管家语音小管家
原创a year ago
逻辑智能|全球首个语音语言模型开源全家桶 LLaSO 来了

语音语言模型(LSLM)领域长期面临碎片化发展困境:架构路径各异、训练数据私有、评估标准缺失,这些问题严重阻碍了技术进步和公平比较。近日,北京深度逻辑智能科技有限公司推出LLaSO——全球首个完全开源的端到端语音语言模型研究框架,旨在为LS…

开源模型
16 0 0
听得清,识得准,语音识别模型Qwen3-ASR-Flash来了!
语音小管家语音小管家
转载a year ago
听得清,识得准,语音识别模型Qwen3-ASR-Flash来了!

今天,我们正式推出通义千问系列最新的语音识别模型 Qwen3-ASR-Flash,它基于Qwen3基座模型,经海量多模态数据以及千万⼩时规模的ASR(自动语音识别)数据训练构建而成。 Qwen3-ASR-Flash实现了⾼精度⾼鲁棒性的语⾳…

开源模型
11 0 0
全球最强开源模型一夜易主,1320亿参数推理飙升2倍!
新智元新智元
转载3 years ago
全球最强开源模型一夜易主,1320亿参数推理飙升2倍!

就在刚刚,全球最强开源大模型王座易主,创业公司Databricks发布的DBRX,超越了Llama 2、Mixtral和Grok-1。MoE又立大功!这个过程只用了2个月,1000万美元,和3100块H100。 全球最强开源模型,一夜易主!…

开源模型
54 0 0
‹12›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)7语音信号处理论文优选:Handling Background Noise in Neural Speech Generation8TIOBE 场景测试:经济 金融 货币9TIOBE 场景测试:汽车之家 汽车评测10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 2999 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号