摘要
多智能体辩论(MAD)是提升大语言模型推理能力的有效策略,但观点收敛究竟源于真实审议还是社会顺从尚不明确。本文指出传统答案翻转率混淆了自发不稳定、立场诱导顺从及推理诱导说服三种机制,并提出三源分解框架加以隔离。实验显示,仅自我反思即可导致 37% 的观点变化,而严格顺从在主要设置中占 29% 且多有害。研究进一步揭示即使空洞推理也具显著说服力,并提出了基于风险预测的干预措施以减少有害顺从,但在缺乏正确性标签时难以区分有益与有害影响。
AI 推荐理由
论文核心研究多智能体辩论中的推理收敛机制,区分真实推理与社会顺从。
研究机构
北京理工大学
深圳大学
Osaka University
论文信息