GUI Agents Reinforcement Learning Knowledge Compression Web Automation
摘要

当前 GUI 智能体训练受限于不安全交互或昂贵人工数据。本文提出 WebFactory,一种全自动闭环强化学习流程,旨在将大模型隐含的网络知识高效压缩为可执行的具身动作。该流程包含环境合成、任务生成及分解奖励训练等模块。实验表明,仅用少量网站合成数据训练的代理,其性能媲美基于大量人工标注数据训练的模型,展现了卓越的数据效率与泛化能力,为通用交互式智能体提供了可扩展的新范式。

AI 推荐理由

核心研究如何将 LLM 知识压缩为具体的 GUI 操作技能,涉及工具使用与动作执行。

研究机构
复旦大学 明势AI
论文信息
作者 Sicheng Fan, Qingyun Shi, Shengze Xu, Shengbo Cai, Tieyong Zeng et al.
发布日期 2026-03-05
arXiv ID 2603.05044
相关性评分 9/10 (高度相关)