Agent Architecture Code Editing Task Decomposition SWE-bench
摘要

大型语言模型代理在软件工程任务中进展显著,但现有方法存在上下文耦合问题:标准代码编辑界面将检查、规划与执行混杂,导致无关信息积累并降低性能。为此,本文提出 SWE-Edit,将代码编辑分解为两个专用子代理:按需提取代码的“查看器”和执行修改的“编辑器”,使主代理专注于推理。此外,针对查找替换格式易错的问题,利用 GRPO 训练 Qwen3-8B 自适应选择编辑模式。实验表明,该方法在 SWE-bench Verified 上解决率提升 2.1%,推理成本降低 17.9%。

AI 推荐理由

论文核心在于将代码编辑任务分解为查看与执行子代理,优化任务规划架构。

研究机构
Microsoft, Redmond, Washington, United States
论文信息
作者 Yikai Zhang, Jiaxin Pei, Kenan Li, Maoquan Wang, Jin Pan et al.
发布日期 2026-04-28
arXiv ID 2604.26102
相关性评分 9/10 (高度相关)