Plan Compliance SWE-agent Agent Evaluation Task Planning
摘要

本文首次系统分析了编程智能体对指令计划的遵循情况。研究发现,缺乏明确计划时,智能体依赖不完整或过拟合的内部工作流;提供标准计划可提升任务解决率,定期提醒能减少违规。然而,劣质计划比无计划更糟,早期增加额外阶段若与模型内部策略不符反而降低性能。结果表明,需通过微调教会模型自适应遵循计划,而非记忆特定工作流。

AI 推荐理由

论文核心研究代理对指令计划的遵循度、计划变体影响及规划与内部策略的冲突。

研究机构
University of Illinois Urbana-Champaign, USA IBM, USA
论文信息
作者 Shuyang Liu, Saman Dehghan, Jatin Ganhotra, Martin Hirzel, Reyhaneh Jabbarvand
发布日期 2026-04-13
arXiv ID 2604.12147
相关性评分 9/10 (高度相关)