Android Agent Reinforcement Learning Sample Efficiency Tool Use
摘要

在线强化学习是增强 Android 智能体能力的有效方法,但受限于模拟器高延迟及现有算法采样效率低,成本高昂。本文指出当前“单状态单动作”范式的根本局限,提出

AI 推荐理由

论文核心在于通过新范式提升 Android Agent 的工具交互与动作执行效率,属技能学习范畴。

研究机构
Zhejiang University Qualcomm AI Research
论文信息
作者 Guo Gan, Yuxuan Ding, Cong Chen, Yuwei Ren, Yin Huang et al.
发布日期 2026-04-08
arXiv ID 2604.07277
相关性评分 9/10 (高度相关)