metacognition evaluation benchmark belief revision model scaling
摘要

本文提出 MEDLEY-BENCH,一个行为元认知基准,旨在评估模型在独立推理、私下自我修正及社会影响下修正观点的能力。研究涵盖 12 个家族的 35 个模型,发现评估能力随模型规模增长,但控制能力并未同步提升,揭示了“知行之隙”。结果表明,元认知能力并非单纯依赖规模,小模型在某些表现上可媲美大模型。该基准为衡量社会压力下的信念修正提供了新工具,建议未来训练应奖励校准后的比例更新。

AI 推荐理由

论文核心研究元认知中的推理监控与自我修正机制,直接关联推理能力的评估与改进。

研究机构
Department of Clinical Science, Intervention and Technology (CLINTEC), Karolinska Institutet, 17177 Stockholm, Sweden Department of Clinical Physiology, Karolinska University Hospital, 17176 Stockholm, Sweden Department of Medical Technologies, Karolinska University Hospital, 14157 Huddinge, Sweden Department of Biomedical Engineering and Health Systems, KTH Royal Institute of Technology, 14157 Huddinge, Sweden
论文信息
作者 Farhad Abtahi, Abdolamir Karbalaie, Eduardo Illueca-Fernandez, Fernando Seoane
发布日期 2026-04-17
arXiv ID 2604.16009
相关性评分 9/10 (高度相关)