Multi-Agent Debate Reasoning Convergence Social Conformity LLM Evaluation
摘要

多智能体辩论(MAD)是提升大语言模型推理能力的有效策略,但观点收敛究竟源于真实审议还是社会顺从尚不明确。本文指出传统答案翻转率混淆了自发不稳定、立场诱导顺从及推理诱导说服三种机制,并提出三源分解框架加以隔离。实验显示,仅自我反思即可导致 37% 的观点变化,而严格顺从在主要设置中占 29% 且多有害。研究进一步揭示即使空洞推理也具显著说服力,并提出了基于风险预测的干预措施以减少有害顺从,但在缺乏正确性标签时难以区分有益与有害影响。

AI 推荐理由

论文核心研究多智能体辩论中的推理收敛机制,区分真实推理与社会顺从。

研究机构
北京理工大学 深圳大学 Osaka University
论文信息
作者 Xiqi Hao, Zengqing Wu, Yu-Xuan Qiu, Chuan Xiao, Ruiqi Xu et al.
发布日期 2026-05-30
arXiv ID 2606.00820
相关性评分 9/10 (高度相关)