ACL 2026 | SDiaReward:面向多轮口语对话的端到端奖励建模与评测基准
近日,浙江大学团队提出的论文SDiaReward: Modeling and Benchmarking Spoken Dialogue Rewards with Modality and Colloquialness被ACL 2026 Ma…
16 0 0
近日,浙江大学团队提出的论文SDiaReward: Modeling and Benchmarking Spoken Dialogue Rewards with Modality and Colloquialness被ACL 2026 Ma…
来源丨夕小瑶科技说 当前具身智能研发正面临“双重枷锁”:一方面,真机验证成本高、仿真偏差大,制约策略验证效率;另一方面,海量真机数据尚未构建基于轨迹扩增的高效利用机制,导致数据未被充分利用,制约了模型的持续进化。为打破这一困局,智元机器人在…