摘要
在线强化学习是增强 Android 智能体能力的有效方法,但受限于模拟器高延迟及现有算法采样效率低,成本高昂。本文指出当前“单状态单动作”范式的根本局限,提出
AI 推荐理由
论文核心在于通过新范式提升 Android Agent 的工具交互与动作执行效率,属技能学习范畴。
研究机构
Zhejiang University
Qualcomm AI Research
论文信息