摘要
针对现有 3D 场景合成代理框架中基于启发式规则导致执行流次优及逐步审查引入延迟的问题,本文提出 SceneOrchestra。该可训练编排框架通过两阶段策略微调编排器与判别器,实现上下文感知的工具选择及完整工具调用轨迹生成,消除了单步审查循环。推理时仅使用编排器生成并执行全轨迹。实验表明,该方法在降低运行时间的同时,实现了最先进的场景质量。
AI 推荐理由
论文核心在于优化 Agent 的工具调用轨迹生成与任务执行流,属于典型的多步规划问题。
研究机构
University of Maryland, College Park
论文信息