声浪
OpenAI要跳过5.3,直接迈向GPT-5.4了?
来源丨机器之心 OpenAI 要略过 GPT-5.3,直接迈向 GPT-5.4 了? 近日,一名 OpenAI 工程师在公开的 Codex GitHub 仓库中提交了一则拉取请求(PR),无意间让 GPT-5.4 这一型号出现在代码版本判断…
21 0 0
通义最新发布语音双模型,一句话即可自由生成!
在传统语音生成中,表达方式往往依赖预设标签,例如: 固定情绪选项 预定义语气类别 限定风格模板 用户只能在有限选项中选择,而难以进行更自由、细腻的表达控制。 FreeStyle 新范式的核心突破在于 不再依赖固定标签,而是支持通过自然语言指…
28 0 0
百度开源轻量级音频大模型Eureka-Audio
标题:Eureka-Audio: Triggering Audio Intelligence in Compact Language Models 链接:https://arxiv.org/pdf/2602.13954 发表日期:2026年…
38 0 0
击败谷歌、英伟达!清华陈建宇×斯坦福Chelsea团队世界模型Ctrl-World具身能力登顶全球
来源丨机器之心 在全球具身智能领域的顶级权威评测 WorldArena 榜单中,清华陈建宇(星动纪元创始人)团队联合斯坦福 Chelsea Finn(PI 创始人) 团队研发的 Ctrl-World 世界模型交出优异答卷: 具身任务能力斩获…
17 0 0
从 “能说话” 到 “会说话”:Meta+MIT 联手打出 GSRM “声学 + 推理” 组合拳,合成语音自然度赢率飙升 82%
以下文章来源于AI随想录,作者William 论文标题: GSRM: Generative Speech Reward Model for Speech RLHF 论文链接: https://arxiv.org/pdf/2602.13891…
20 0 0
