Multi-Agent Simulation Moral Learning Self-Adaptation Social Dynamics LLM Agents
摘要

本文探讨了榜样在塑造集体道德中的作用,构建了一个由大语言模型驱动的多智能体模拟系统。在该系统中,具有不同内在驱动力(从合作到竞争)的智能体通过“计划 - 行动 - 观察 - 反思”的四阶段认知循环进行交互与适应。研究设计了四种实验游戏(对齐、崩溃、冲突与建设),并通过动机消融实验识别模仿的关键驱动因素。结果表明,身份驱动的从众行为能强力覆盖初始倾向,智能体持续调整其价值观以 align 感知到的成功榜样,从而导致价值观的快速收敛。

AI 推荐理由

论文核心研究 Agent 通过反思与模仿榜样实现价值观的自我适应与收敛,属于典型的自我进化机制。

研究机构
北京师范大学 加州大学洛杉矶分校
论文信息
作者 Junjie Liao, Huacong Tang, Zhou Ziheng, Yizhou Wang, Fangwei Zhong
发布日期 2026-03-14
arXiv ID 2603.13876
相关性评分 9/10 (高度相关)