摘要
深度研究智能体需整合复杂信息检索与多步推理以解决现实问题,而在长程任务中,可靠的验证机制至关重要。现有范式因缺乏显式验证导致错误累积。本文提出 Marco DeepResearch,采用以验证为中心的框架:在数据合成阶段控制问题难度并确保答案唯一正确;在轨迹构建中注入显式验证模式;在推理时利用智能体自身进行验证扩展。实验表明,该智能体在多项基准测试中显著优于同规模模型,甚至在有限工具调用下媲美更大规模模型。
AI 推荐理由
论文核心在于通过验证机制增强多步推理的可靠性,解决长程任务中的错误传播问题。
研究机构
Alibaba International Digital Commerce
论文信息