摘要
本文探讨代理式 3D 空间理解,指出现有方法因忽略场景异质性而滥用工具。为此,提出 Skill-3D 框架,学习自我演化的场景感知技能。该框架将成功轨迹蒸馏为可复用技能,失败轨迹作为教训,构建场景记忆。当相似场景重现时,注入技能引导代理,形成记忆与技能库协同演化的闭环。实验表明,该方法显著提升 3D 空间推理中的工具利用率,并通过技能引导轨迹的后训练进一步增强模型性能。
AI 推荐理由
论文提出自我进化框架,通过记忆与技能库协同演化实现场景感知技能的持续改进。
研究机构
浙江大学
论文信息