语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
大语言模型为什么能像人一样说话和思考?
语音小管家语音小管家
原创5 months ago
大语言模型为什么能像人一样说话和思考?

李航,张少华,林苑 我们每天都在使用大语言模型(Large Language Model,LLM)。一个明显的感受是,它们似乎真的能够理解我们的语言,虽然有时也会出现幻觉。另一方面,观察 LLM 输出的思维链,也就是其推理过程的语言表示,我…

语言模型
47 0 0
语音/音频处理学术速递[5.18]
每日语音速递每日语音速递
原创5 months ago
语音/音频处理学术速递[5.18]

语音合成语音识别
31 0 0
ICASSP 2026 | URGENT Challenge Overview:迈向通用、鲁棒、可泛化的语音增强
语音小管家语音小管家
转载5 months ago
ICASSP 2026 | URGENT Challenge Overview:迈向通用、鲁棒、可泛化的语音增强

本期为大家介绍基于ICASSP 2026 URGENT 语音增强比赛的总结论文[1]。在本届 ICASSP 2026 中,我们围绕 URGENT Challenge 的组织与评测工作,完成了 challenge overview 论文。 I…

语音增强
32 0 0
arXiv严惩「用AI不核查」行为,违者拉黑一年,连坐所有作者
语音小管家语音小管家
转载5 months ago
arXiv严惩「用AI不核查」行为,违者拉黑一年,连坐所有作者

全球研究者注意:论文预印本上传平台 arXiv 又出新规了! 今天凌晨,俄勒冈州立大学杰出教授(荣休)、arXiv 计算机科学分区 CoRR 的机器学习板块首席版主 Thomas G. Dietterich 宣布:根据我们的行为准则,在论文…

资讯
31 0 0
语音/音频处理学术速递[5.15]
每日语音速递每日语音速递
原创5 months ago
语音/音频处理学术速递[5.15]

语音合成语音识别
25 0 0
语音/音频处理学术速递[5.14]
语音小管家语音小管家
原创5 months ago
语音/音频处理学术速递[5.14]

语音合成语音识别
22 0 0
Dolphin-CN-Dialect 发布:同样的数据,换一种配方,让ASR听懂更多中国话
语音小管家语音小管家
转载5 months ago
Dolphin-CN-Dialect 发布:同样的数据,换一种配方,让ASR听懂更多中国话

今天,海天瑞声与清华大学电子工程系语音与音频技术实验室(SATLab),发布Dolphin-CN-Dialect 汉语多方言语音识别模型! 获取渠道 体验地址 · 非流式识别:

语音识别
55 0 0
【交我学-32】大模型也能"听出方位"了?空间音频理解的最新进展
语音小管家语音小管家
转载5 months ago
【交我学-32】大模型也能"听出方位"了?空间音频理解的最新进展

AudioCC交我学 作为学术研究者与实践者的连接点,我们致力于打造一个专注于语音技术的学术交流平台——「AudioCC交我学」专栏。在这里,我们将以简洁、专业的视角,解读听觉认知与计算声学领域的前沿论文,分享技术创新与应用实践的最新动态。…

48 0 0
香港中文大学(深圳)人工智能学院HLT 实验室李海洲教授招募语音/大模型方向博士后
语音小管家语音小管家
原创5 months ago
香港中文大学(深圳)人工智能学院HLT 实验室李海洲教授招募语音/大模型方向博士后

香港中文大学(深圳)人工智能学院HLT 实验室李海洲教授招募语音/大模型方向博士后,长期有效,欢迎加入我们! 课题组介绍 香港中文大学(深圳)语音语义实验室(Human Language Technology Laboratory, HLT…

309 1 0
语音/音频处理学术速递[5.13]
每日语音速递每日语音速递
原创5 months ago
语音/音频处理学术速递[5.13]

语音识别语音合成
20 0 0
‹1…2627282930…479›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6语音信号处理论文优选:Handling Background Noise in Neural Speech Generation7详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)8TIOBE 场景测试:汽车之家 汽车评测9TIOBE 场景测试:经济 金融 货币10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号