Self-Reflection Cognitive Bias Dialectical Alignment Multi-Agent Systems
摘要

大型语言模型智能体正演变为能执行复杂自主工作流的动态系统。为提升可靠性,多智能体框架常被用于实现自我反思与相互审计。然而,这种角色扮演会引发类似人类的“行动者 - 观察者不对称性”认知偏差:智能体在自我反思时倾向于将失败归因于外部因素,而在审计他人时则归因于内部缺陷。本文提出 ReTAS 方法,通过辩证对齐训练强制视角不变推理,结合辩证思维链与群组相对策略优化,引导智能体综合冲突观点达成客观共识,显著提升了模糊场景下的故障解决率。

AI 推荐理由

论文核心解决 Agent 自我反思中的认知偏差,通过辩证对齐实现自我改进与自适应。

研究机构
National University of Singapore Sichuan University University of Minnesota Twin Cities Harbin Institute of Technology, Shenzhen University of Oxford
论文信息
作者 Bobo Li, Rui Wu, Zibo Ji, Meishan Zhang, Hao Fei et al.
发布日期 2026-04-21
arXiv ID 2604.19548
相关性评分 9/10 (高度相关)