摘要
现有世界动作模型常将世界预测与动作生成割裂。本文形式化提出世界 - 动作交互模型(WAIMs),并以 DAWN 为例在自动驾驶中实例化。DAWN 在紧凑语义潜空间中耦合世界预测器与世界条件动作去噪器,通过递归反馈机制互相 refine 预测。该方法仅需短时显式潜空间推演,即可支持复杂交互场景下的长程轨迹生成。实验表明,DAWN 在多个基准测试中展现出卓越的规划性能与安全结果,为构建可操作的世界模型提供了新路径。
AI 推荐理由
论文提出世界 - 动作交互模型,核心解决自动驾驶中的长程轨迹生成与规划问题。
研究机构
COWARobot Co. Ltd
Shanghai Jiao Tong University
Hohai University
论文信息