摘要
本文实证发现,在思维链和 ReAct 代理中,语义扰动(如改写)比同等严重程度的表面扰动(如格式调整)更易改变最终答案。通过对 68 个实验单元的大规模测试及第 11 个模型的保留数据验证,证实了该不一致性差距显著存在。研究 retract 了部分先前机制主张,提出“隐性分歧”现象:语义扰动虽保留初始动作,但导致后续中间推理步骤发散且轨迹略深。本研究提供了带有保留验证的测量贡献及部分轨迹级机理解释。
AI 推荐理由
论文核心研究语义噪声对思维链及 ReAct 代理推理过程的影响机制。
研究机构
School of Information and Software Engineering, UESTC
Jacobs School of Engineering, UC San Diego
论文信息