Deep Research Verification Multi-step Reasoning Agent Framework
摘要

深度研究智能体需整合复杂信息检索与多步推理以解决现实问题,而在长程任务中,可靠的验证机制至关重要。现有范式因缺乏显式验证导致错误累积。本文提出 Marco DeepResearch,采用以验证为中心的框架:在数据合成阶段控制问题难度并确保答案唯一正确;在轨迹构建中注入显式验证模式;在推理时利用智能体自身进行验证扩展。实验表明,该智能体在多项基准测试中显著优于同规模模型,甚至在有限工具调用下媲美更大规模模型。

AI 推荐理由

论文核心在于通过验证机制增强多步推理的可靠性,解决长程任务中的错误传播问题。

研究机构
Alibaba International Digital Commerce
论文信息
作者 Bin Zhu, Qianghuai Jia, Tian Lan, Junyang Ren, Feng Gu et al.
发布日期 2026-03-30
arXiv ID 2603.28376
相关性评分 9/10 (高度相关)