摘要
连续环境中的视觉语言导航(VLN-CE)要求智能体遵循自然语言指令在类真实环境中导航。现有方法多采用三阶段框架,但解耦范式常导致路点不可达或规划与控制不一致。本文提出“轨迹路点”新范式,将候选路点 grounded 于可执行轨迹中。通过设计 TSDF 引导的扩散策略作为轨迹路点预测器,确保路点可达性;并提出轨迹增强导航器,注入轨迹信息以保障高层语义决策与底层执行的一致性。实验表明该范式显著优于基线。
AI 推荐理由
论文提出轨迹中心范式,解决导航中规划与执行不一致问题,核心聚焦任务规划。
研究机构
Harbin Institute of Technology (Shenzhen)
论文信息