摘要
大型语言模型智能体正演变为能执行复杂自主工作流的动态系统。为提升可靠性,多智能体框架常被用于实现自我反思与相互审计。然而,这种角色扮演会引发类似人类的“行动者 - 观察者不对称性”认知偏差:智能体在自我反思时倾向于将失败归因于外部因素,而在审计他人时则归因于内部缺陷。本文提出 ReTAS 方法,通过辩证对齐训练强制视角不变推理,结合辩证思维链与群组相对策略优化,引导智能体综合冲突观点达成客观共识,显著提升了模糊场景下的故障解决率。
AI 推荐理由
论文核心解决 Agent 自我反思中的认知偏差,通过辩证对齐实现自我改进与自适应。
研究机构
National University of Singapore
Sichuan University
University of Minnesota Twin Cities
Harbin Institute of Technology, Shenzhen
University of Oxford
论文信息