摘要
深度研究代理面临海量、相互依赖且充满不确定性的信息。现有系统将中间表示的进化交由大语言模型的隐式推理,缺乏显式监管导致错误传播。本文主张代理的心智模型应通过显式反馈不断对齐任务理解与现实,并识别出解释性更新、偏差反馈和模式修订三个调节循环。VeriTrace 作为认知图框架实现了这些循环,在 DeepResearch Bench 和 DeepConsult 基准测试中显著优于基线,取得了最强的可复现开源结果。
AI 推荐理由
论文核心提出心智模型显式进化机制,通过三个调节循环实现自我修正与适应。
研究机构
Department of Engineering, University of Cambridge
TUM School of Management, Technical University of Munich
论文信息