摘要
针对现有代理式文本生成图像方法依赖人工先验、决策僵化及忽视效率的问题,本文提出 OctoT2I 框架。该框架将生成质量与推理效率联合优化,采用基于记忆的多轮路由策略自适应选择工具。核心创新在于无需人工监督的自进化机制,通过“提议 - 解决 - 评估 - 学习”循环自主构建知识库并探索工具能力边界,实现持续自我改进。实验表明,该方法在保持竞争力的同时显著提升了推理速度与能效。
AI 推荐理由
论文提出自进化机制,通过无监督 PSEL 循环自主定义概念并持续优化工具选择策略。
研究机构
北京大学电子工程学院
广东省重点领域研发计划超高清视频与媒体技术省级实验室,深圳研究生院,北京大学
论文信息