摘要
针对开放世界游戏中长程多模态代理在有限资源下难以保持目标导向的问题,本文提出 SPIKE 框架。该框架采用自适应双控制器架构:战略控制器负责低频全局规划、故障分析与恢复;反应式控制器在严格令牌预算下处理快速局部执行。通过事件触发器监控状态变化以动态切换控制模式,并结合分层记忆机制区分短期经验复用与结构化知识检索。实验表明,该方法在提升成功率的同时显著降低了令牌消耗与延迟。
AI 推荐理由
论文核心提出自适应双控制器框架,重点解决长程任务中的全局规划与局部执行平衡问题。
研究机构
Zhejiang University
National University of Singapore
Nanyang Technological University
论文信息